실험

슬라이드 5장 7가지 제작 경로 비교: 가장 비싼 쪽이 최하점

읽는 데 약 8분#실험#AI#슬라이드#자동화

이 글의 독자AI로 발표자료를 만들어 볼까 고민 중인 사람, 직접 만든 생성 코드를 계속 유지할지 고민하는 사람

한줄 요약: 같은 슬라이드 5장을 일곱 가지 방법으로 만들고 비용과 시간, 규격 준수를 실측했습니다. 실제로 청구된 금액끼리만 비교하면 $0.67과 $4.07로 6배 차이가 났고, 비싼 쪽이 규격을 가장 못 지켰습니다. 구독료를 사용량으로 나눈 환산치까지 넣으면 격차는 45배까지 벌어집니다. 그리고 제 채점표가 못 잡는 차이가 하나 있어서, 재는 축을 하나 더 만들었습니다.

발표자료를 만드는 도구가 너무 많아졌습니다. 저는 몇 달에 걸쳐 python-pptx로 슬라이드 생성기를 직접 만들어 쓰고 있는데, 요즘 나오는 도구들을 보면 이 코드를 계속 고쳐 가며 쓰는 게 맞나 싶어집니다.

그래서 재 봤습니다. 같은 슬라이드 5장을 일곱 가지 방법으로 만들고, 얼마가 들고 얼마나 걸리고 내가 정한 규격을 얼마나 지키는지를 숫자로 뽑았습니다.

목차

  1. 실험 설계
  2. 결과: 가장 비싼 경로가 가장 나빴습니다
  3. 이미지 생성이 색상 코드를 따라 그립니다
  4. 제 채점표가 못 잡은 차이
  5. Canva MCP가 무너진 지점
  6. 만드는 비용과 고치는 비용은 다릅니다
  7. 정리

실험 설계

비교가 성립하려면 일곱 경로에 완전히 같은 것을 줘야 합니다. 슬라이드 문구 35개를 파일 하나에 못박고, 프롬프트도 파일 하나로 고정했습니다. 경로마다 다른 것은 마지막 “이 도구에서는 이렇게 만들어라” 한 문단뿐입니다.

대조군소유 python-pptx 생성기몇 달 다듬어 온 내 코드. 이걸 계속 유지할 이유가 있는지가 이 실험의 질문
비교군codex 내장 image_gen, Gemini nano-banana-pro, Canva MCP, Genspark 표준, Genspark Ultra, Claude Design6경로
조작변인슬라이드를 만드는 도구와 서비스이것 하나만 바꿉니다
통제변인문구 35개, 프롬프트 1개, 디자인 규격, 절차spec.json 문자열 그대로, common.md 프롬프트 문자 단위 동일(sha256 87f83347…), 팔레트 8색과 Noto Sans KR, 16:9 5장, 재시도 3회, 경로당 30분 상한, 실행 순서 고정
  • 비용 USD (회계 기준 병기)
  • 소요 시간 초 (제출부터 규격 충족까지)
  • 문자열 정확도 35개 대조
  • 배경색 오차 RGB 거리
  • 규격 밖 유채색 비율
  • 요구 형태 충실도 눈 판정 (결과를 보고 추가한 축)
교란변인 (통제 못 해 기록만 함)대조군에 유리한 편향 2가지팔레트 8색이 내 생성기의 기본값이라 대조군은 색 점수를 공짜로 얻습니다. 생성기에 이미 몇 달치 투자가 들어가 있는데 제작 시간에는 안 잡힙니다. 실행 순서가 고정이라 뒤로 갈수록 제가 익숙해집니다. Claude Design만 사람이 앱에서 직접 조작했고 나머지는 자동화라 시간을 같은 자로 잰 값이 아닙니다. Genspark은 내보내기가 유료 게이트라 정식 산출물이 아니라 화면을 캡처해 채점했습니다
실험 설계. 프롬프트 파일 하나를 일곱 경로가 전부 읽습니다.

통제 못 하는 것을 숨기지 않고 적어 두는 이유는, 그게 결론을 바꾸는 자리이기 때문입니다. 이 구분이 왜 중요한지는 A/B 테스트가 태어난 이유에서 교란 변수와 랜덤화 이야기로 더 자세히 다뤘습니다.

슬라이드 5장은 「AI와 에이전트는 뭐가 다른가」라는 주제로 짰습니다. 표지 한 장, 순환 도식 한 장, 3열 5행 비교표 한 장, 큰 숫자 한 장, 마무리 한 장입니다. 표와 도식과 큰 숫자를 일부러 섞은 이유는, 도구마다 못 만드는 형태가 바로 거기서 드러나기 때문입니다.

채점은 두 가지를 기계로 했습니다. 하나는 문자열 정확도입니다. 산출물에서 텍스트를 뽑아 원본 35개와 대조합니다. 다른 하나는 색상 준수입니다. PNG 픽셀에서 가장 많은 색을 뽑아 규격 배경색과의 거리를 재고, 규격 팔레트 8색 밖의 유채색이 화면에서 몇 퍼센트인지 셉니다.

결과: 가장 비싼 경로가 가장 나빴습니다

경로 비용 소요 배경색 오차 규격 밖 색 형태 충실도
소유 python-pptx $3.77 실청구 287초 0.0 0.6% 이하 부분
codex 내장 image_gen $0.65 환산 200초 2.2 이하 1.4% 이하 충족
Gemini nano-banana-pro $0.67 종량 150초 7.0 이하 0.5% 이하 충족
Canva MCP $4.07 실청구 390초 22.7 19% 이상 미충족
Genspark 표준 $0.09 환산 180초 1.0 0.9% 이하 미충족
Genspark Ultra $0.16 환산 500초 1.0 0.6% 이하 충족
Claude Design 미측정 348초 0.0 0.9% 이하 충족

문자열은 일곱 경로 모두 만점이라 표에서 뺐습니다. 한글이 깨지거나 문구가 바뀌는 일은 한 번도 없었습니다. 갈린 것은 규격을 지키느냐였습니다.

Genspark만 크레딧으로 과금됩니다. 제가 실제로 돌린 계정은 Free 플랜이라 현금 지출은 $0이었고, 크레딧 차감만 재면 표준 티어 5장에 35 크레딧, Ultra 티어 5장에 65 크레딧이었습니다. 이걸 달러로 옮기려면 유료 요금제 단가가 필요합니다. 공식 요금 화면에 Plus가 월 $24.99에 월 10,000 크레딧으로 나와 있으니 크레딧당 $0.0025이고, 35 크레딧은 $0.09, 65 크레딧은 $0.16입니다. 연간 결제를 하면 월 $19.99라 여기서 더 내려갑니다.

7경로 비교 시트. 세로가 경로, 가로가 순환 도식과 비교표와 큰 숫자 세 장. 여섯 줄은 밝은 회색 배경에 파란 강조색으로 통일돼 있고, Canva 줄만 진남색 테두리에 크림색 카드로 확연히 다르다.
능력차가 갈리는 세 장(순환 도식, 비교표, 큰 숫자)을 7경로로 나란히 놓았습니다. 그림을 누르면 원본 크기로 볼 수 있습니다.

이미지 생성이 색상 코드를 따라 그립니다

이 실험에서 제가 가장 크게 틀린 예상입니다. AI 이미지 생성에 #2563EB 같은 색상 코드를 주면 대충 비슷한 파란색이 나올 거라고 봤는데, 실제로는 표 머리행 배경 채움과 그 아래 파란 밑줄까지 규격대로 그렸습니다.

AI 이미지 생성으로 만든 슬라이드. 에이전트는 루프로 일한다는 제목 아래, 관찰과 판단과 도구 실행 세 상자가 삼각형으로 배치되고 곡선 화살표로 순환하며, 가운데에 목표에 도달할 때까지 반복이라는 라벨이 있다.
codex 내장 image_gen이 그린 순환 도식. 되돌아오는 화살표까지 정확합니다.

경로 이름을 정확히 적어 둡니다. “GPT 이미지 생성”이라고 뭉뚱그리면 틀립니다. 이 경로는 codex CLI 0.153.4를 gpt-6-astra 모델로 돌리고, 그림은 codex의 내장 image_gen 도구가 그렸습니다. gpt-6-astra는 지시를 받아 도구를 부르는 쪽이지 그림을 그리는 모델이 아니고, 내장 도구가 뒤에서 어느 이미지 모델을 쓰는지는 로그에 남지 않습니다. 그래서 이미지 모델 이름은 적지 않았습니다. 반대쪽 경로는 이름이 분명합니다. Gemini API에 nano-banana-pro-preview를 직접 지정해 호출했습니다.

이 순환 도식은 제 소유 코드가 못 만든 형태이기도 합니다. 생성기에 등록된 도식 유형이 직선 화살표뿐이라, 고리를 그리려면 보조 코드를 따로 붙여야 했습니다. 소유 코드는 어휘에 없는 형태를 만나면 매번 코드를 고쳐야 하고, 그게 유지비입니다.

그리고 이 대목이 제 생성기에 가장 아팠던 결과입니다. 배경색 오차 0.0을 낸 경로는 둘뿐인데, 하나는 제 소유 코드고 다른 하나는 Claude Design입니다. 팔레트는 오히려 Claude Design이 8색을 다 썼고 제 코드는 7색이었습니다. 색을 제 코드만큼 정확히 맞추면서, 제 코드가 못 만드는 고리를 만들었습니다. 몇 달 다듬은 코드가 산 우위가 정확도였는데, 그 우위가 여기서는 남지 않았습니다.

배경색 오차 0.0을 낸 두 경로의 순환 도식 슬라이드를 나란히 놓은 비교. 왼쪽 소유 python-pptx는 상자 세 개가 가로 일렬이고 아래로 점선이 되돌아간다. 오른쪽 Claude Design은 상자 세 개가 삼각형으로 놓이고 세 화살표가 고리를 이룬다.
같은 배경색 오차 0.0. 왼쪽이 제 생성기, 오른쪽이 Claude Design입니다.

다만 이미지를 그려 내는 두 경로, 곧 codex와 Gemini에는 다른 값이 붙습니다. 둘 다 요청한 해상도를 못 지켰습니다. codex 쪽은 스스로 이렇게 보고했습니다.

해상도 조건은 미충족입니다. 1920×1080을 요청했지만 도구가 1672×941로 반환했습니다. 코드 렌더링은 사용하지 않았습니다.

그리고 산출물이 이미지이므로 텍스트를 기계로 뽑아 검증할 수 없습니다. 오탈자 검수를 자동화할 수 없다는 뜻입니다.

제 채점표가 못 잡은 차이

채점표대로만 보면 두 티어는 같은 결과를 냈습니다. 그래서 저는 비싼 티어가 산 것이 더 나은 디자인이 아니라 재시도 횟수뿐이라고 봤습니다. 결과물을 나란히 놓아 보기 전까지는요.

Genspark를 표준과 Ultra 두 티어로 돌렸을 때 기존 종속변인은 전부 사실상 동점이었습니다. 배경색 오차 1.0으로 같고, 팔레트 적중도 같고, 요구 요소도 둘 다 5/5였습니다. 그런데 결과물을 나란히 놓고 보면 다릅니다.

Genspark 표준 티어와 Ultra 티어가 만든 순환 도식 슬라이드를 나란히 놓은 비교. 왼쪽 표준은 상자 세 개가 가로 일렬로 놓이고 아래로 화살촉 없는 곡선이 지나간다. 오른쪽 Ultra는 상자 세 개가 삼각형으로 배치되고 세 개의 화살표가 실제로 고리를 이룬다.
왼쪽 표준, 오른쪽 Ultra. 스펙은 "순환하는 고리"를 요구했는데 왼쪽은 일렬입니다.

문제는 요구 요소가 존재 여부만 세는 검사였다는 데 있습니다. “상자 3개가 있는가”는 보지만 “그 상자들이 고리로 배치되고 마지막에서 첫 상자로 화살표가 돌아오는가”는 보지 않습니다. 그래서 일렬로 늘어놓고 화살촉 없는 곡선을 그은 것도 만점을 받았습니다.

그래서 종속변인을 하나 더 만들었습니다. 요구 형태 충실도입니다. 스펙이 형태를 지정한 장에 대해 세 가지를 봅니다.

검사 미충족이 되는 경우
상자 3개가 도형으로 존재 텍스트 나열로 대체
배치가 고리 (원형이나 삼각) 일렬 직선 배치
마지막에서 첫 상자로 화살표 화살촉 없는 선, 또는 없음

이 잣대로 다시 채점하니 순위가 갈렸습니다. codex와 Gemini와 Ultra와 Claude Design은 충족, 소유 코드는 부분, Genspark 표준과 Canva는 미충족입니다.

비싼 티어가 산 것은 재시도 횟수만이 아니었습니다. 재시도 차이도 실제로 있었습니다. 표준은 비교표가 화면 아래로 189px 넘쳐 자체 검증 루프가 두 번 돌며 스스로 고쳤고, Ultra는 다섯 장 전부 첫 시도에 넘침 없이 나왔습니다. 거기에 도식의 형태까지 더 맞았습니다.

65가 맞다면 표준과 Ultra의 차이는 $0.09와 $0.16, 차액 $0.07입니다. 그 정도면 저는 표준을 건너뛰고 Ultra로 가겠습니다. 도식이 들어가는 장에서 표준은 형태를 못 맞추는데, 그걸 고치려고 다시 돌리는 비용이 $0.07보다 큽니다. 대신 2.8배 느리니 급할 때는 표준을 씁니다.

Canva MCP가 무너진 지점

가장 비쌌고 가장 오래 걸렸는데 결과가 가장 나빴습니다. 원인은 편집 API의 구조였습니다.

Canva로 만든 비교표 슬라이드. 진남색 테두리 안에 크림색 카드가 있고, 표 대신 구분 파이프 문자로 구분된 텍스트 다섯 줄이 나열돼 있다. 격자선이 없고 푸터도 없다.
표를 요구했는데 파이프 문자로 구분된 텍스트가 나왔습니다.

Canva 편집 API가 제공하는 것은 텍스트 교체, 요소 삭제, 위치와 크기 변경, 서식 지정, 이미지 채우기뿐입니다. 요소를 새로 추가하는 기능이 없습니다. 그래서 자동 생성이 뱉은 템플릿에 들어 있는 요소만 재활용할 수 있고, 템플릿에 표나 도형이 없으면 그 슬라이드는 만들 방법이 없습니다. 배경색을 바꾸는 기능도 없어서 템플릿의 진남색을 그대로 안고 갔습니다.

만드는 비용과 고치는 비용은 다릅니다

실무에서 진짜 시간을 먹는 건 처음 만들 때가 아니라 고칠 때입니다. 그래서 완성된 5장에 표 행 하나를 추가하라고 시켜 봤습니다. 이 시행은 네 경로에만 돌렸습니다. Genspark 두 티어와 Claude Design은 고칠 때 비용을 안 쟀습니다.

경로 수정 비용 소요 결과
Gemini nano-banana-pro $0.134 24초 행 추가됨. 푸터 오염
codex 내장 image_gen $0.83 150초 행 추가됨. 다른 장 영향 없음
소유 python-pptx $1.21 68초 데이터 한 줄 수정 후 재빌드
Canva MCP $1.75 110초 행 추가됨. 다만 표가 아니라 텍스트라 한 줄 추가

여기서도 예상이 빗나갔습니다. 이미지를 다시 생성하면 나머지 장과 톤이 어긋날 거라고 봤는데, 배경색 이동이 0.2 이내였습니다. 육안으로는 구분되지 않습니다.

대신 다른 사고가 났습니다. Gemini는 행을 정확히 추가했는데, 푸터에 디자인 규격 지시문이 그대로 새어 들어갔습니다.

Gemini가 다시 생성한 비교표 슬라이드의 아래쪽. 우하단 푸터가 Noto Sans KR 20px 색상코드로 시작해 저작권 문구로 이어진다.
Noto Sans KR, 20px, #1E293B.가 붙어 나왔습니다. 지시문이 결과물로 새어 나온 것입니다.

이미지 생성은 지시와 내용의 경계가 없습니다. 프롬프트에 적은 규격이 그림 안에 글자로 등장할 수 있고, 이걸 기계로 잡아낼 방법이 없습니다.

정리

이 글은 격주로 도는 실험 기록의 한 편입니다. 다음 편에서는 같은 방식으로 다른 작업을 재 볼 생각입니다. 실험 페이지에서 이 연재만 모아 볼 수 있습니다.

댓글

    핀번호는 내 댓글을 지울 때 필요합니다.

    뉴스레터

    새 글을 메일로 받아보세요

    AI 자동화 튜토리얼과 저자 코멘터리를 보냅니다. 스팸 없이, 새 글이 올라올 때만.

    구독하기 ›