为内容付费给 AI:2026 年的真实成本

我们都已经习惯把文章丢给 AI。这个习惯是要付账单的。下面是 2026 年 8 月主流 API 上一篇中等长度文章的真实成本,以及这份账单不再划算的那个临界点。

标价

价格以每 1M tokens 的美元计价,已于 2026 年 8 月对照各家官方价格页核实。距离我们 7 月版本仅过去一个月,整张表又一次全部翻新 — 在为流水线做预算之前,请先核对各家的价格页。

厂商模型InputOutput
AnthropicClaude Fable 5(旗舰)$10$50
Claude Opus 5$5$25
Claude Sonnet 5(中端)$3$15
Claude Haiku 4.5(低价)$1$5
OpenAIGPT-5.5 Pro(旗舰)$30$180
GPT-5.6 Sol$5$30
GPT-5.6 Terra(中端)$2$12
GPT-5.6 Luna(低价)$0.20$1.20
GoogleGemini 3.1 Pro$2.00$12
Gemini 3.7 Flash$0.75$3.75
Gemini 3.5 Flash-Lite$0.30$2.50
xAIGrok 4.6$2$6
Grok 4.3$1.25$2.50
DeepSeekV4 Pro(off-peak)$0.66$1.98
V4 Flash(off-peak)$0.22$0.66
AlibabaQwen3.8 Max$2$6
Qwen3.7 Plus$0.32$1.28
Qwen3.7 Flash$0.03$0.13
MoonshotKimi K3$3$15
Kimi K2.5$0.60$3.00
MistralMedium 3.5$1.50$7.50
Large 3$0.50$1.50
Small 4$0.15$0.60

Mistral 是本月唯一没有变动的一块 — 上表其余各家的价格都是 7 月以来的新价,Moonshot 的 Kimi 也首次登上这张表(其旗舰 K3 的定价与 Claude Sonnet 5 完全相同)。在每一个档位上,output 都比 input 贵 2–6×。这一点很关键:长文章的绝大部分是 output tokens;而带着长系统 prompt 的短简报,绝大部分是 input。这一次挂在头条数字上的脚注比以往更多 — Claude Sonnet 5 的引导期价格($2/$10)将于 2026-08-31 到期;Gemini 3.7 Flash 也是引导期价格(自 2027 年 1 月起涨为 $1.50/$7.50);Gemini 3.1 Pro 与 Grok 4.6 在超过 200K token 的上下文后价格大约翻倍(分别为 $4/$18 与 $4/$12);DeepSeek 按时段计价 — 表中所列为错峰价,高峰时段(UTC 01:00–04:00 与 06:00–10:00)价格翻倍;Qwen3.7 Flash 则按请求长度分档(32K token 以内为 $0.03/$0.13,最高可达 $0.20/$0.80)。

一篇文章到底花多少钱

一篇中等长度的文章 — 大约 2,500 词 — 大致落在 3,000 个 input tokens(系统 prompt、简报、模板说明、素材)和 3,500 个 output tokens(约 2,500 词)。按这组数字计算:

模型标价 / 篇用 cache(读取折扣)cache + batch
GPT-5.5 Pro~$0.72n/a~$0.36
Claude Fable 5~$0.21~$0.18~$0.089
GPT-5.6 Sol~$0.12~$0.11~$0.053
Claude Opus 5~$0.10~$0.089~$0.045
Claude Sonnet 5~$0.062~$0.053~$0.027
Kimi K3~$0.062~$0.053n/a
GPT-5.6 Terra~$0.048~$0.043~$0.021
Gemini 3.1 Pro~$0.048~$0.043~$0.021
Mistral Medium 3.5~$0.031~$0.027~$0.013
Qwen3.8 Max~$0.027~$0.024~$0.014(仅 batch)
Grok 4.6~$0.027~$0.023~$0.018(batch −20%)
Claude Haiku 4.5~$0.021~$0.018~$0.009
Gemini 3.7 Flash~$0.015~$0.013~$0.0067
Kimi K2.5~$0.012n/a~$0.0074(batch −40%)
Gemini 3.5 Flash-Lite~$0.0097~$0.0088~$0.0044
DeepSeek V4 Pro(off-peak)~$0.0089~$0.0070n/a
Mistral Large 3~$0.0068~$0.0054~$0.0027
GPT-5.6 Luna~$0.0048~$0.0043~$0.0021
DeepSeek V4 Flash(off-peak)~$0.003~$0.0023n/a
Mistral Small 4~$0.0026~$0.0021~$0.0011
Qwen3.7 Flash~$0.00055n/a~$0.00027

像 Luna、Gemini Flash-Lite 或 Haiku 这样的低价档,按标价能把一篇文章压到一到两美分。Qwen3.7 Flash 落在大约二十分之一美分 — 这是新的价格下限,因为 DeepSeek 这次调价把它挤出了原来的位置。GPT-5.5 Pro 这样的真旗舰,成本大约是 Qwen Flash 的 1,300×,是 Sonnet 5、GPT-5.6 Terra 这类中端档的 12–15×。

真正能用上的折扣

对任何规模化产出 AI 内容的人来说,有两个机制值得关注 — 这个月它们的附加条件又变多了:

  • Prompt caching。Anthropic、OpenAI、Google、xAI、DeepSeek、Alibaba、Moonshot 和 Mistral 都对缓存 input 的读取给折扣 — 通常是 90% 的减免(Anthropic、OpenAI、Google、Mistral、Moonshot)、75%(xAI),DeepSeek 即使在 8 月的调价之后依然接近 97%,其 cache-hit 价格仍是本页面上单项杠杆最大的一条。代价在另一头:缓存写入要加价(Anthropic 对 5 分钟 TTL 收 1.25×,1 小时收 2×;OpenAI 在 GPT-5.6 系列上加了 1.25× 的写入费),而且 Google 还按小时收存储费。只有当缓存前缀确实被重复读取若干次,caching 才划算。
  • Batch API。Anthropic、OpenAI、Google、Alibaba 和 Mistral 对 24 小时内完成的异步任务提供 50% 折扣。但它并不是普遍的 50%:xAI 只减 20%Moonshot 的 batch 价是标价的 60%(−40%,其旗舰 K3 更是完全不在 batch 价格页上),Alibaba 不允许 batch 与 cache 在同一请求上叠加,而 DeepSeek 的折扣看的是时段,不是队列 — 8 月 16 日的调价恢复了错峰/高峰计价,错峰时段(一天中的大部分时间)价格是高峰时段的一半。

两者都存在时可以叠加。Batch + cache 大致能让 input 比标价便宜约 95%、output 便宜 50%。如果你是用固定的系统 prompt、按计划分批生成内容,这两个都该用上

规模化之后的算术

选一个合理的中端模型 — Claude Sonnet 5 按标价,每篇 $0.062:

规模纯 AI(每次重新生成)AI 出一次模板 + 本地渲染
1 篇$0.06$0.06
100 篇~$6.15~$0.06
1,000 篇~$61.50~$0.06
10,000 篇~$615~$0.06

换成 GPT-5.5 Pro 这样的旗舰,差距还会拉大:10,000 篇按标价约需要 $7,200,而另一边只是生成一个好模板的成本(远低于 $1),再用本地渲染器免费跑。这就是账单不再划算的那一刻。

模型阵容比你的内容计划变得更快

这里还有一项任何价格页都不会列出的成本。本文 2026 年 4 月版里点名的每一个模型 — GPT-5.4、Gemini 3 Flash、Grok 4、DeepSeek V3 与 R1、Qwen3 Max、Mistral Small 3.1、Claude Opus 4.7 与 Sonnet 4.6 — 此后都已被改名、取代或废弃。三个月而已。OpenAI 把数字档位换成了命名档位(Sol / Terra / Luna)。DeepSeek 干脆下线了 deepseek-chatdeepseek-reasoner 这两个别名。

7 月版本仅撑了不到一个月。此后:Anthropic 发布了 Claude Opus 5(2026-07-24),表中列出的那个 Opus 就此成为上一代;OpenAI 把 GPT-5.6 Terra 降价 20%、Luna 降价 80%(2026-07-30);Google 相隔五周先后推出了 Gemini 3.6 Flash 与 3.7 Flash;xAI 发布了 Grok 4.6(2026-08-12);Alibaba 用 Qwen3.8 Max 替换了 Qwen3.7 Max(2026-08-03);DeepSeek 在高峰时段把价格最多上调了 1,100%(2026-08-16),重新引入了它随 V4 一代取消的按时段计价。一个月里,七家厂商中有六家改动了价格表。

如果你的内容流水线每次渲染都要调一次模型,上面每一次变动都是一次迁移:新的模型 ID、重新调过的 prompt、重新核算的成本,以及读起来和上个季度不一样的产出。如果你的流水线只调用模型一次来写模板、之后都在本地渲染,这些都与你无关。模型更迭不只是麻烦,它本身就是选择模板路线的理由。

什么时候应该按篇付费

不是每篇文章都是重复品。以下情况,付这份 API 账单是值得的:

  • 有独特语气或独特切入角度的一次性编辑稿;
  • 你从未覆盖过的新话题,模型需要真的做调研;
  • 细腻度比产量更重要的长篇特稿;
  • 反正你都会大幅手工编辑的草稿。

这类工作,你要用你负担得起的最好的模型。旗舰档的产出,会用节省下来的编辑时间把成本赚回来。

什么时候应该付一次、渲染很多次

只要你需要产出同一种形态的文章超过几次,成本的算术就会反转:

  • 覆盖整个 SKU 目录的产品页;
  • 跨语言、跨地区的本地化变体;
  • 针对长关键词列表的 SEO 落地页;
  • 结构共享的多租户 SaaS 营销站点;
  • 任何结构恒定、只有事实在变的场景。

在这里,按次渲染付费纯属浪费。用 AI 把模板写好一次,然后把渲染交给一个免费完成它的工具。

混合工作流

这正是 Spintax 为之而生的工作流:

  1. 为旗舰付一次费。用你负担得起的最好模型 — Fable 5、Opus 5、GPT-5.6 Sol、Gemini 3.1 Pro — 来撰写模板。你付 $0.05–$1,换来一个高质量、语法安全、多变体的模板。
  2. 此后永远在本地渲染。Spintax 在你自己的 CPU 上解析模板。成千上万个变体的成本实际为零。
  3. 只在语义变化时更新。只有当事实或定位发生变化时才重新生成模板 — 而不是在厂商给模型改名时。对一个稳定的产品来说,这大概是一个季度一次。

该花钱的地方为质量付费,不再为数量付费。

注意事项

  • 价格会变,名字也会变。上面整张表在 2026 年 4 月到 7 月之间全部翻新了一遍,7 月到 8 月之间又翻新了一次。做预算前请重新核对各家价格页,也绝不要写死一个本季度没有重新验证过的模型 ID。
  • 缓存写入不是免费的。标题上那个「90% 折扣」针对的是缓存读取。Anthropic 和 OpenAI 都对写入收溢价,Google 还按小时收存储费。一个只被读取一次的缓存,比不用缓存更贵。
  • Batch 并非到处都是 50%。xAI 是 20%。Moonshot 是 40%,且不含其旗舰模型。Alibaba 不允许 batch 与 cache 叠加。DeepSeek 的折扣看的是时段,不是 batch 队列。在核实之前,别假设折扣可以叠加。
  • 部分厂商的长上下文要额外收费。Gemini Pro 档位与 Grok 4.6 在超过 200K tokens 后价格大约翻倍。Anthropic 和 OpenAI 在整个上下文窗口内按统一费率计费。
  • 各档位的质量并不相同。低价档适合搭骨架和改写。细腻的语气、长上下文的保真度和事实的可靠性,仍然是旗舰的地盘。廉价模型用来做本地渲染,而不是用来写模板本身。

接下来读什么

准备好把一次高质量的 AI 生成变成成千上万次渲染了吗?从写作指南系列开始:

数据来源:Anthropic、OpenAI、Google、xAI、DeepSeek、Alibaba、Moonshot、Mistral 的官方价格页 — 核对于 2026-08-20。单篇成本按每篇 3,000 个 input tokens + 3,500 个 output tokens 计算。