AIにコンテンツ料金を払う: 2026年の実コスト

私たちは記事をAIに任せることにすっかり慣れました。その習慣には請求書が伴います。2026年8月時点で、主要APIにおいて中規模の記事1本が実際にいくらかかるのか — そして、その請求書が割に合わなくなる瞬間を示します。

表示価格

価格は1MトークンあたりのUSD、2026年8月にプロバイダーの価格ページで検証済みです。7月版からのわずか1か月でテーブルはまた総入れ替えになりました — パイプラインの予算を組む前に、必ずプロバイダーのページを確認してください。

プロバイダーモデルInputOutput
AnthropicClaude Fable 5 (フラッグシップ)$10$50
Claude Opus 5$5$25
Claude Sonnet 5 (ミドル)$3$15
Claude Haiku 4.5 (低価格)$1$5
OpenAIGPT-5.5 Pro (フラッグシップ)$30$180
GPT-5.6 Sol$5$30
GPT-5.6 Terra (ミドル)$2$12
GPT-5.6 Luna (低価格)$0.20$1.20
GoogleGemini 3.1 Pro$2.00$12
Gemini 3.7 Flash$0.75$3.75
Gemini 3.5 Flash-Lite$0.30$2.50
xAIGrok 4.6$2$6
Grok 4.3$1.25$2.50
DeepSeekV4 Pro (off-peak)$0.66$1.98
V4 Flash (off-peak)$0.22$0.66
AlibabaQwen3.8 Max$2$6
Qwen3.7 Plus$0.32$1.28
Qwen3.7 Flash$0.03$0.13
MoonshotKimi K3$3$15
Kimi K2.5$0.60$3.00
MistralMedium 3.5$1.50$7.50
Large 3$0.50$1.50
Small 4$0.15$0.60

Mistralは今月動かなかった唯一のブロックです — 上の表の他のプロバイダーの価格はすべて7月以降の新しい価格で、Moonshotの Kimi が今回初めてこの表に加わりました (フラッグシップのK3はちょうどClaude Sonnet 5と同じ価格に収まっています)。どのティアでもoutputはinputの2–6×高くつきます。これは重要です: 長い記事の大部分はoutputトークンです。長いシステムプロンプトを伴う短いブリーフは、大部分がinputです。見出しの数字にはこれまで以上に注釈が付きます — Claude Sonnet 5の導入価格 ($2/$10) は2026-08-31に終了します。Gemini 3.7 Flashも導入価格です ($1.50/$7.50、2027年1月から)。Gemini 3.1 ProとGrok 4.6は200Kトークンを超えるコンテキストでおよそ倍額になります ($4/$18と$4/$12)。DeepSeekは時間帯によって価格が変わります — 表はoff-peak (非ピーク時間帯) を示しており、ピーク時間帯 (UTCで01:00–04:00と06:00–10:00) は倍額になります。そしてQwen3.7 Flashはリクエスト長で段階的に変わります (32Kトークン未満は$0.03/$0.13、最大で$0.20/$0.80)。

記事1本の実コスト

中規模の記事 — およそ2,500ワード — はおおむね3,000 inputトークン (システムプロンプト、ブリーフ、テンプレート指示、ソース資料) と3,500 outputトークン (~2,500ワード) に収まります。この数字で計算すると:

モデル記事1本の定価キャッシュあり (読み取り割引)キャッシュ + batch
GPT-5.5 Pro~$0.72n/a~$0.36
Claude Fable 5~$0.21~$0.18~$0.089
GPT-5.6 Sol~$0.12~$0.11~$0.053
Claude Opus 5~$0.10~$0.089~$0.045
Claude Sonnet 5~$0.062~$0.053~$0.027
Kimi K3~$0.062~$0.053n/a
GPT-5.6 Terra~$0.048~$0.043~$0.021
Gemini 3.1 Pro~$0.048~$0.043~$0.021
Mistral Medium 3.5~$0.031~$0.027~$0.013
Qwen3.8 Max~$0.027~$0.024~$0.014 (batchのみ)
Grok 4.6~$0.027~$0.023~$0.018 (batch −20%)
Claude Haiku 4.5~$0.021~$0.018~$0.009
Gemini 3.7 Flash~$0.015~$0.013~$0.0067
Kimi K2.5~$0.012n/a~$0.0074 (batch −40%)
Gemini 3.5 Flash-Lite~$0.0097~$0.0088~$0.0044
DeepSeek V4 Pro (off-peak)~$0.0089~$0.0070n/a
Mistral Large 3~$0.0068~$0.0054~$0.0027
GPT-5.6 Luna~$0.0048~$0.0043~$0.0021
DeepSeek V4 Flash (off-peak)~$0.003~$0.0023n/a
Mistral Small 4~$0.0026~$0.0021~$0.0011
Qwen3.7 Flash~$0.00055n/a~$0.00027

Luna、Gemini Flash-Lite、Haikuのような低価格ティアなら、定価でも記事1本が1–2セントに収まります。Qwen3.7 Flashは1セントの20分の1近くまで下がります — DeepSeekの値上げがその座から外れたことで生まれた新しい底値です。GPT-5.5 Proのような真のフラッグシップは、Qwen Flashのおよそ1,300×、Sonnet 5やGPT-5.6 Terraのようなミドルティアの12–15×のコストです。

実際に効く割引

AIコンテンツを量産する人にとって重要な仕組みは2つ — そして今月、どちらもまた条件付きになりました:

  • Prompt caching. Anthropic、OpenAI、Google、xAI、DeepSeek、Alibaba、Moonshot、Mistralはいずれもキャッシュ済みinputの読み取りを割り引きます — 典型的には90%オフ (Anthropic、OpenAI、Google、Mistral、Moonshot)、75%オフ (xAI)、そしてDeepSeekでは約97%オフです — DeepSeekのcache-hit価格は、8月の値上げ後も依然としてこのページ最大の単独レバーです。落とし穴は反対側にあります: キャッシュの書き込みには割増がかかります (AnthropicはTTL 5分で1.25×、1時間で2×を課金。OpenAIはGPT-5.6ファミリーに1.25×の書き込み料金を追加しました)。Googleは時間課金のストレージ料金も取ります。キャッシュが割に合うのは、キャッシュ済みプレフィックスを実際に何度か読み直す場合だけです。
  • Batch API. Anthropic、OpenAI、Google、Alibaba、Mistralは、24時間以内に完了する非同期ジョブに50%オフを提供します。もはや一律50%ではありません: xAIの割引は20%のみMoonshotはbatchを定価の60%で課金します (−40%、しかもフラッグシップのK3はbatchページに一切載っていません)、Alibabaは同じリクエストでbatchとキャッシュを併用できません、そしてDeepSeekの割引は時間帯次第で、キューではありません — 8月16日の値上げでpeak/off-peakの課金が復活し、off-peak (1日の大半) はpeakの半額になりました。

両方が存在する場合、割引は重ねられます。Batch + キャッシュで、inputは定価からおよそ95%オフ、outputは50%オフになります。固定のシステムプロンプトでスケジュールされたバッチでコンテンツを生成しているなら、両方を使うべきです

スケール時の計算

妥当なミドルティアのモデルを選びます — Claude Sonnet 5、定価で記事1本$0.062:

本数純AI (毎回再生成)AIでテンプレートを1回 + ローカルレンダー
1本$0.06$0.06
100本~$6.15~$0.06
1,000本~$61.50~$0.06
10,000本~$615~$0.06

GPT-5.5 Proのようなフラッグシップが相手なら差はさらに開きます: 10,000本は定価でおよそ$7,200。対して、良質なテンプレートを1回生成するコスト ($1をかなり下回る) と、それをローカルのレンダラーに通す無料の処理で済みます。ここが、請求書が割に合わなくなる瞬間です。

モデルのラインアップは、あなたのコンテンツ計画より速く入れ替わる

ここにはどの価格ページにも載っていない、もう一つのコストがあります。本記事の2026年4月版で挙げたモデル — GPT-5.4、Gemini 3 Flash、Grok 4、DeepSeek V3とR1、Qwen3 Max、Mistral Small 3.1、Claude Opus 4.7とSonnet 4.6 — はすべて、その後に改名、置き換え、または非推奨になりました。わずか3か月です。OpenAIは数値ティアをやめ、名前付きティア (Sol / Terra / Luna) に切り替えました。DeepSeekはdeepseek-chatdeepseek-reasonerのエイリアスをきっぱり廃止しました。

7月版はわずか1か月しかもちませんでした。それ以降: AnthropicはClaude Opus 5を投入し (2026-07-24)、その表に載っていたOpusは旧世代になりました。OpenAIはGPT-5.6 Terraを20%、Lunaを80%値下げしました (2026-07-30)。Googleは5週間の間隔でGemini 3.6 Flash、続いて3.7 Flashを投入しました。xAIはGrok 4.6を投入しました (2026-08-12)。AlibabaはQwen3.7 MaxをQwen3.8 Maxに置き換えました (2026-08-03)。そしてDeepSeekはピーク時に最大1,100%の値上げを行い (2026-08-16)、V4で廃止していた時間帯別課金を復活させました。1か月で、7社中6社が価格を変更しました。

コンテンツパイプラインがレンダーのたびにモデルを呼ぶなら、これらの変更のひとつひとつが移行作業です: 新しいモデルID、プロンプトの再調整、コストの再算定、そして前四半期とは読み味の違う出力。パイプラインがテンプレートを書くために1回だけモデルを呼び、あとはローカルでレンダーするなら、そのどれもあなたには関係ありません。モデルの入れ替わりの速さは、単なる不便ではなく、テンプレートを選ぶ理由そのものです。

記事ごとに払うべきとき

すべての記事が繰り返しではありません。API料金を払う価値があるのは:

  • 独自の声や切り口を持つ、一点物の編集記事;
  • これまで扱ったことのない新しいトピックで、モデルが実際にリサーチを行う場合;
  • 量より機微が重要なロングフォーム記事;
  • どのみち手作業で大幅に編集する下書き。

この種の仕事には、支払える範囲で最良のモデルを使うべきです。フラッグシップ級の出力は、編集時間の削減で元が取れます。

1回払って何度もレンダーすべきとき

同じ形の記事を数回以上作らなければならなくなった瞬間、コストの計算は逆転します:

  • SKUカタログ全体にわたる商品ページ;
  • 言語と地域ごとのローカライズ版;
  • 長大なキーワードリストに対応するSEOランディングページ;
  • 構造を共有するマルチテナントSaaSのマーケティングサイト;
  • 構造が一定で、事実だけが変わるものすべて。

ここでレンダーごとに払うのは純粋な無駄です。テンプレートはAIで1回書き、レンダーは無料でやってくれるツールに任せましょう。

ハイブリッドなワークフロー

これこそSpintaxが想定しているワークフローです:

  1. フラッグシップに1回だけ払う。 支払える範囲で最良のモデル — Fable 5、Opus 5、GPT-5.6 Sol、Gemini 3.1 Pro — を使ってテンプレートを書かせます。$0.05–$1で、高品質かつ文法的に安全な、多変種テンプレートが手に入ります。
  2. あとはローカルで、いつまでもレンダー。 SpintaxはテンプレートをあなたのマシンのCPUで展開します。数千の変種のコストは実質ゼロです。
  3. 意味が変わったときだけ更新する。 テンプレートを再生成するのは、事実やポジショニングが変わったとき — ベンダーがモデルを改名したときではありません。安定したプロダクトなら、四半期に1回程度でしょう。

重要なところでは品質に払う。量に払うのはやめる。

注意点

  • 価格も名前も変わります。 上のテーブルは2026年4月から7月のあいだに丸ごと入れ替わり — そして7月から8月のあいだにまた入れ替わりました。予算を組む前にプロバイダーのページを再確認し、今四半期に再検証していないモデルIDを決してハードコードしないでください。
  • キャッシュの書き込みは無料ではありません。 見出しの「90%オフ」はキャッシュの読み取りに適用されます。AnthropicもOpenAIも書き込みには割増を課金し、Googleは時間課金のストレージ料金を取ります。1回しか読まれないキャッシュは、キャッシュしないより高くつきます。
  • Batchはどこでも50%ではありません。 xAIは20%。Moonshotは40%で、フラッグシップは対象外です。Alibabaはbatchとキャッシュの併用を認めていません。DeepSeekの割引は時間帯によるもので、batchキューではありません。確認する前に、割引が重ねられる前提で計算しないでください。
  • プロバイダーによってはロングコンテキストが割高です。 Gemini ProティアとGrok 4.6は200Kトークンを超えるとおよそ倍額になります。AnthropicとOpenAIはコンテキストウィンドウ全域で一律料金です。
  • 品質はどのティアでも同じではありません。 低価格ティアは骨組み作りやリライトには十分です。細やかな声、ロングコンテキストの忠実さ、事実に基づく記述は、依然としてフラッグシップが有利です。安価なモデルはローカルレンダー用に使い、テンプレートそのものには使わないでください。

次に読むもの

1回の優れたAI生成を数千のレンダーに変える準備はできましたか。まずは執筆シリーズから:

以下のシリーズは英語のみで公開されています。

データ出典: Anthropic、OpenAI、Google、xAI、DeepSeek、Alibaba、Moonshot、Mistralの価格ページ — 2026-08-20に検証。記事1本あたりの計算は、記事ごとに3,000 inputトークン + 3,500 outputトークンを前提としています。