콘텐츠를 AI에 맡기는 비용: 2026년 실제 가격
우리는 모두 아티클을 AI에 맡기는 데 익숙해졌습니다. 그 습관에는 청구서가 따라옵니다. 2026년 8월 기준으로 중간 길이 아티클 한 편이 주요 API에서 실제로 얼마인지 — 그리고 그 청구서가 더 이상 말이 되지 않는 지점은 어디인지 살펴봅니다.
정가
가격은 1M 토큰당 USD 기준이며, 2026년 8월에 각 제공사의 가격 페이지와 대조해 검증했습니다. 7월판 이후 단 한 달 만에 표가 다시 갈아엎어졌습니다 — 파이프라인 예산을 잡기 전에 제공사 페이지를 확인하세요.
| 제공사 | 모델 | Input | Output |
|---|---|---|---|
| Anthropic | Claude Fable 5 (플래그십) | $10 | $50 |
| Claude Opus 5 | $5 | $25 | |
| Claude Sonnet 5 (중급) | $3 | $15 | |
| Claude Haiku 4.5 (저가) | $1 | $5 | |
| OpenAI | GPT-5.5 Pro (플래그십) | $30 | $180 |
| GPT-5.6 Sol | $5 | $30 | |
| GPT-5.6 Terra (중급) | $2 | $12 | |
| GPT-5.6 Luna (저가) | $0.20 | $1.20 | |
| Gemini 3.1 Pro | $2.00 | $12 | |
| Gemini 3.7 Flash | $0.75 | $3.75 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | |
| xAI | Grok 4.6 | $2 | $6 |
| Grok 4.3 | $1.25 | $2.50 | |
| DeepSeek | V4 Pro (off-peak) | $0.66 | $1.98 |
| V4 Flash (off-peak) | $0.22 | $0.66 | |
| Alibaba | Qwen3.8 Max | $2 | $6 |
| Qwen3.7 Plus | $0.32 | $1.28 | |
| Qwen3.7 Flash | $0.03 | $0.13 | |
| Moonshot | Kimi K3 | $3 | $15 |
| Kimi K2.5 | $0.60 | $3.00 | |
| Mistral | Medium 3.5 | $1.50 | $7.50 |
| Large 3 | $0.50 | $1.50 | |
| Small 4 | $0.15 | $0.60 |
Mistral은 이번 달 유일하게 바뀌지 않은 블록입니다 — 그 위 표의 다른 모든 가격은 7월 이후 새로 바뀐 것이며, Moonshot의 Kimi가 이번에 처음으로 표에 합류했습니다(플래그십 K3는 정확히 Claude Sonnet 5와 같은 가격입니다). 모든 등급에서 output은 input보다 2–6× 비쌉니다. 이 점이 중요합니다: 긴 아티클은 대부분 output 토큰입니다. 시스템 프롬프트가 긴 짧은 브리프는 대부분 input입니다. 대표 가격에 붙는 각주는 그 어느 때보다 많아졌습니다 — Claude Sonnet 5는 2026-08-31까지 도입 프로모션 가격($2/$10)이 적용되고, Gemini 3.7 Flash도 도입 가격입니다($1.50/$7.50, 2027년 1월부터 정가로 전환). Gemini 3.1 Pro와 Grok 4.6은 200K 토큰을 넘는 컨텍스트에서 대략 두 배가 되며($4/$18, $4/$12), DeepSeek은 시간대별로 가격이 매겨집니다 — 표는 off-peak 가격이고 피크 시간대(01:00–04:00, 06:00–10:00 UTC)에는 두 배가 됩니다. Qwen3.7 Flash는 요청 길이에 따라 단계별로 가격이 매겨집니다(32K 토큰 미만은 $0.03/$0.13, 최대 $0.20/$0.80까지).
아티클 한 편의 실제 비용
중간 길이 아티클 — 대략 2,500 단어 — 은 3,000 input 토큰(시스템 프롬프트, 브리프, 템플릿 지침, 원자료)과 3,500 output 토큰(~2,500 단어) 정도에 해당합니다. 이 수치를 기준으로 계산하면:
| 모델 | 정가 기준 건당 | 캐시 적용(읽기 할인) | 캐시 + batch |
|---|---|---|---|
| GPT-5.5 Pro | ~$0.72 | n/a | ~$0.36 |
| Claude Fable 5 | ~$0.21 | ~$0.18 | ~$0.089 |
| GPT-5.6 Sol | ~$0.12 | ~$0.11 | ~$0.053 |
| Claude Opus 5 | ~$0.10 | ~$0.089 | ~$0.045 |
| Claude Sonnet 5 | ~$0.062 | ~$0.053 | ~$0.027 |
| Kimi K3 | ~$0.062 | ~$0.053 | n/a |
| GPT-5.6 Terra | ~$0.048 | ~$0.043 | ~$0.021 |
| Gemini 3.1 Pro | ~$0.048 | ~$0.043 | ~$0.021 |
| Mistral Medium 3.5 | ~$0.031 | ~$0.027 | ~$0.013 |
| Qwen3.8 Max | ~$0.027 | ~$0.024 | ~$0.014 (batch only) |
| Grok 4.6 | ~$0.027 | ~$0.023 | ~$0.018 (batch −20%) |
| Claude Haiku 4.5 | ~$0.021 | ~$0.018 | ~$0.009 |
| Gemini 3.7 Flash | ~$0.015 | ~$0.013 | ~$0.0067 |
| Kimi K2.5 | ~$0.012 | n/a | ~$0.0074 (batch −40%) |
| Gemini 3.5 Flash-Lite | ~$0.0097 | ~$0.0088 | ~$0.0044 |
| DeepSeek V4 Pro (off-peak) | ~$0.0089 | ~$0.0070 | n/a |
| Mistral Large 3 | ~$0.0068 | ~$0.0054 | ~$0.0027 |
| GPT-5.6 Luna | ~$0.0048 | ~$0.0043 | ~$0.0021 |
| DeepSeek V4 Flash (off-peak) | ~$0.003 | ~$0.0023 | n/a |
| Mistral Small 4 | ~$0.0026 | ~$0.0021 | ~$0.0011 |
| Qwen3.7 Flash | ~$0.00055 | n/a | ~$0.00027 |
Luna, Gemini Flash-Lite, Haiku 같은 저가 등급은 정가 기준으로 아티클 한 편을 1~2센트 수준으로 끝냅니다. Qwen3.7 Flash는 1센트의 20분의 1 근처까지 내려갑니다 — DeepSeek의 가격 재조정이 그 자리에서 밀려나며 생긴 새로운 최저점입니다. GPT-5.5 Pro 같은 진짜 플래그십은 Qwen Flash의 약 1,300×, Sonnet 5나 GPT-5.6 Terra 같은 중급의 12–15× 비용입니다.
실제로 적용되는 할인
AI 콘텐츠를 대량으로 돌리는 사람에게 의미 있는 메커니즘은 두 가지입니다 — 다만 이번 달에는 둘 다 다시 조건이 까다로워졌습니다:
- Prompt caching. Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot, Mistral 모두 캐시된 input 읽기를 할인합니다 — 일반적으로 90% 할인(Anthropic, OpenAI, Google, Mistral, Moonshot), 75% 할인(xAI), 그리고 DeepSeek은 약 97% 할인되며, 8월 가격 재조정 이후에도 이 cache-hit 가격은 여전히 이 페이지에서 가장 강력한 지렛대입니다. 함정은 반대편에 있습니다: 캐시 쓰기에는 할증이 붙고(Anthropic은 5분 TTL에 1.25×, 1시간에 2×를 청구하고, OpenAI는 GPT-5.6 계열에 1.25× 쓰기 요금을 추가했습니다), Google은 시간당 저장 요금을 청구합니다. 캐시는 캐시된 prefix를 실제로 몇 번 다시 읽어야 비로소 이득입니다.
- Batch API. Anthropic, OpenAI, Google, Alibaba, Mistral은 24시간 내에 완료되는 async 작업에 50% 할인을 제공합니다. 보편적인 50%가 아닙니다: xAI는 20%만 할인하고, Moonshot은 batch를 정가의 60%로 청구하며(−40%, 게다가 플래그십 K3는 batch 페이지에 아예 올려두지 않습니다), Alibaba는 같은 요청에서 batch와 캐시를 함께 쓰지 못하게 하며, DeepSeek의 할인은 큐가 아니라 시간대입니다 — 8월 16일 가격 재조정으로 피크/off-peak 요금제가 돌아왔고, off-peak(하루 대부분의 시간)은 피크 요금의 절반입니다.
둘 다 존재하는 곳에서는 중첩 적용됩니다. Batch + 캐시를 쓰면 정가 대비 input은 약 95%, output은 50% 절감됩니다. 고정된 시스템 프롬프트로 예약 배치를 돌려 콘텐츠를 생성하고 있다면, 둘 다 써야 합니다.
규모의 산수
합리적인 중급 모델을 골라봅시다 — 정가 기준 Claude Sonnet 5, 아티클당 $0.062:
| 물량 | 순수 AI (매번 재생성) | AI 템플릿 1회 + 로컬 렌더 |
|---|---|---|
| 1편 | $0.06 | $0.06 |
| 100편 | ~$6.15 | ~$0.06 |
| 1,000편 | ~$61.50 | ~$0.06 |
| 10,000편 | ~$615 | ~$0.06 |
GPT-5.5 Pro 같은 플래그십과 비교하면 격차는 더 벌어집니다: 10,000편이면 정가로 약 $7,200인 반면, 좋은 템플릿 하나를 생성하는 비용($1보다 한참 적습니다)에 로컬 렌더러를 무료로 돌리면 끝입니다. 바로 그 지점에서 청구서가 말이 되지 않게 됩니다.
모델 라인업은 당신의 콘텐츠 계획보다 빨리 바뀝니다
어떤 가격 페이지에도 적혀 있지 않은 두 번째 비용이 있습니다. 이 아티클의 2026년 4월판에 이름을 올렸던 모든 모델 — GPT-5.4, Gemini 3 Flash, Grok 4, DeepSeek V3와 R1, Qwen3 Max, Mistral Small 3.1, Claude Opus 4.7과 Sonnet 4.6 — 은 그 사이에 이름이 바뀌었거나, 후속 모델로 대체됐거나, 지원 중단됐습니다. 겨우 3개월입니다. OpenAI는 숫자 등급을 버리고 이름 등급(Sol / Terra / Luna)으로 갈아탔습니다. DeepSeek은 deepseek-chat과 deepseek-reasoner 별칭을 아예 없앴습니다.
7월판은 겨우 한 달을 버텼습니다. 그 사이: Anthropic이 Claude Opus 5를 출시했고(2026-07-24) 표에 있던 Opus는 이전 세대가 되었습니다. OpenAI는 GPT-5.6 Terra를 20%, Luna를 80% 내렸습니다(2026-07-30). Google은 Gemini 3.6 Flash를 내놓은 뒤 5주 만에 3.7 Flash를 출시했습니다. xAI는 Grok 4.6을 출시했습니다(2026-08-12). Alibaba는 Qwen3.7 Max를 Qwen3.8 Max로 교체했습니다(2026-08-03). 그리고 DeepSeek은 피크 시간대 가격을 최대 1,100%까지 올리며(2026-08-16) V4와 함께 없앴던 시간대별 요금제를 다시 도입했습니다. 한 달 사이 일곱 제공사 중 여섯 곳의 가격표가 바뀌었습니다.
콘텐츠 파이프라인이 렌더할 때마다 모델을 호출한다면, 이런 변화 하나하나가 곧 마이그레이션입니다: 새 모델 ID, 프롬프트 재튜닝, 비용 재산정, 그리고 지난 분기와 다르게 읽히는 출력물. 파이프라인이 템플릿을 작성하려고 모델을 한 번만 호출하고 그 뒤로는 로컬에서 렌더한다면, 어느 것도 당신을 건드리지 않습니다. 모델 교체 주기는 단순한 불편이 아니라 템플릿을 택해야 할 근거입니다.
건당 지불이 맞는 경우
모든 아티클이 반복물은 아닙니다. API 요금을 내는 게 합리적인 경우:
- 고유한 톤이나 관점이 필요한 일회성 편집 기사;
- 다뤄본 적 없는 새 주제, 즉 모델이 실제로 조사를 수행하는 경우;
- 물량보다 뉘앙스가 중요한 롱폼 피처;
- 어차피 손으로 대폭 고칠 초안.
이런 작업에는 감당할 수 있는 최고의 모델을 쓰는 게 맞습니다. 플래그십 등급의 출력물은 편집 시간을 줄여 스스로 값을 합니다.
한 번 지불하고 여러 번 렌더해야 하는 경우
같은 형태의 아티클을 몇 번 이상 만들어야 하는 순간 비용 계산이 뒤집힙니다:
- SKU 카탈로그 전반의 제품 페이지;
- 언어와 지역별 현지화 변형;
- 긴 키워드 목록을 겨냥한 SEO 랜딩 페이지;
- 구조를 공유하는 멀티테넌트 SaaS 마케팅 사이트;
- 구조는 고정이고 사실만 바뀌는 모든 것.
여기서 렌더마다 돈을 내는 건 순수한 낭비입니다. 템플릿은 AI로 한 번 작성하고, 렌더링은 그것을 공짜로 해주는 도구에 넘기세요.
하이브리드 워크플로
Spintax는 바로 이 워크플로를 위해 만들어졌습니다:
- 플래그십에 한 번만 지불한다. 감당할 수 있는 최고의 모델 — Fable 5, Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro — 로 템플릿을 작성합니다. $0.05–$1을 내고 고품질의, 문법적으로 안전한, 다변형 템플릿을 얻습니다.
- 렌더는 영원히, 로컬에서. Spintax는 템플릿을 당신의 CPU에서 해석합니다. 수천 개의 변형 비용은 사실상 0입니다.
- 의미가 바뀔 때만 갱신한다. 벤더가 모델 이름을 바꿨을 때가 아니라, 사실이나 포지셔닝이 바뀔 때만 템플릿을 재생성하세요. 안정된 제품이라면 분기에 한 번 정도일 겁니다.
중요한 곳의 품질에는 값을 치릅니다. 물량에 대한 지불은 멈춥니다.
주의사항
- 가격도, 이름도 바뀝니다. 위 표는 2026년 4월과 7월 사이에 통째로 갈아엎였고 — 7월과 8월 사이에 다시 한 번 갈아엎였습니다. 예산을 잡기 전에 제공사 페이지를 다시 확인하고, 이번 분기에 재검증하지 않은 모델 ID는 절대 하드코딩하지 마세요.
- 캐시 쓰기는 공짜가 아닙니다. 대표적으로 내세우는 “90% 할인”은 캐시 읽기에 적용됩니다. Anthropic과 OpenAI는 쓰기에 할증을 청구하고, Google은 시간당 저장 요금을 청구합니다. 한 번만 읽히는 캐시는 캐시가 없는 것보다 비쌉니다.
- Batch가 어디서나 50%인 것은 아닙니다. xAI는 20%입니다. Moonshot은 40%이고 플래그십은 제외합니다. Alibaba는 batch와 캐시를 함께 쓰지 못하게 합니다. DeepSeek의 할인은 batch 큐가 아니라 시간대입니다. 확인하기 전에 할인 조합이 적용된다고 가정하지 마세요.
- 일부 제공사에서는 롱컨텍스트에 추가 비용이 붙습니다. Gemini Pro 등급과 Grok 4.6은 200K 토큰을 넘어가면 대략 두 배가 됩니다. Anthropic과 OpenAI는 컨텍스트 윈도 전 구간에 균일 요금을 적용합니다.
- 품질은 등급마다 다릅니다. 저가 등급은 뼈대 잡기와 리라이트에는 충분합니다. 섬세한 톤, 롱컨텍스트 충실도, 사실 근거는 여전히 플래그십이 유리합니다. 값싼 모델은 로컬 렌더에 쓰고, 템플릿 자체에는 쓰지 마세요.
다음에 볼 것
좋은 AI 생성 한 번을 수천 번의 렌더로 바꿀 준비가 되셨나요? 작성 가이드 시리즈부터 시작하세요:
작성 가이드 시리즈는 영어로만 제공됩니다.
데이터 출처: Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot, Mistral 가격 페이지 — 2026-08-20 검증. 건당 계산은 아티클 1편당 3,000 input 토큰 + 3,500 output 토큰을 가정합니다.