为内容付费给 AI:2026 年的真实成本
我们都已经习惯把文章丢给 AI。这个习惯是要付账单的。下面是 2026 年 8 月主流 API 上一篇中等长度文章的真实成本,以及这份账单不再划算的那个临界点。
标价
价格以每 1M tokens 的美元计价,已于 2026 年 8 月对照各家官方价格页核实。距离我们 7 月版本仅过去一个月,整张表又一次全部翻新 — 在为流水线做预算之前,请先核对各家的价格页。
| 厂商 | 模型 | Input | Output |
|---|---|---|---|
| Anthropic | Claude Fable 5(旗舰) | $10 | $50 |
| Claude Opus 5 | $5 | $25 | |
| Claude Sonnet 5(中端) | $3 | $15 | |
| Claude Haiku 4.5(低价) | $1 | $5 | |
| OpenAI | GPT-5.5 Pro(旗舰) | $30 | $180 |
| GPT-5.6 Sol | $5 | $30 | |
| GPT-5.6 Terra(中端) | $2 | $12 | |
| GPT-5.6 Luna(低价) | $0.20 | $1.20 | |
| Gemini 3.1 Pro | $2.00 | $12 | |
| Gemini 3.7 Flash | $0.75 | $3.75 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | |
| xAI | Grok 4.6 | $2 | $6 |
| Grok 4.3 | $1.25 | $2.50 | |
| DeepSeek | V4 Pro(off-peak) | $0.66 | $1.98 |
| V4 Flash(off-peak) | $0.22 | $0.66 | |
| Alibaba | Qwen3.8 Max | $2 | $6 |
| Qwen3.7 Plus | $0.32 | $1.28 | |
| Qwen3.7 Flash | $0.03 | $0.13 | |
| Moonshot | Kimi K3 | $3 | $15 |
| Kimi K2.5 | $0.60 | $3.00 | |
| Mistral | Medium 3.5 | $1.50 | $7.50 |
| Large 3 | $0.50 | $1.50 | |
| Small 4 | $0.15 | $0.60 |
Mistral 是本月唯一没有变动的一块 — 上表其余各家的价格都是 7 月以来的新价,Moonshot 的 Kimi 也首次登上这张表(其旗舰 K3 的定价与 Claude Sonnet 5 完全相同)。在每一个档位上,output 都比 input 贵 2–6×。这一点很关键:长文章的绝大部分是 output tokens;而带着长系统 prompt 的短简报,绝大部分是 input。这一次挂在头条数字上的脚注比以往更多 — Claude Sonnet 5 的引导期价格($2/$10)将于 2026-08-31 到期;Gemini 3.7 Flash 也是引导期价格(自 2027 年 1 月起涨为 $1.50/$7.50);Gemini 3.1 Pro 与 Grok 4.6 在超过 200K token 的上下文后价格大约翻倍(分别为 $4/$18 与 $4/$12);DeepSeek 按时段计价 — 表中所列为错峰价,高峰时段(UTC 01:00–04:00 与 06:00–10:00)价格翻倍;Qwen3.7 Flash 则按请求长度分档(32K token 以内为 $0.03/$0.13,最高可达 $0.20/$0.80)。
一篇文章到底花多少钱
一篇中等长度的文章 — 大约 2,500 词 — 大致落在 3,000 个 input tokens(系统 prompt、简报、模板说明、素材)和 3,500 个 output tokens(约 2,500 词)。按这组数字计算:
| 模型 | 标价 / 篇 | 用 cache(读取折扣) | cache + batch |
|---|---|---|---|
| GPT-5.5 Pro | ~$0.72 | n/a | ~$0.36 |
| Claude Fable 5 | ~$0.21 | ~$0.18 | ~$0.089 |
| GPT-5.6 Sol | ~$0.12 | ~$0.11 | ~$0.053 |
| Claude Opus 5 | ~$0.10 | ~$0.089 | ~$0.045 |
| Claude Sonnet 5 | ~$0.062 | ~$0.053 | ~$0.027 |
| Kimi K3 | ~$0.062 | ~$0.053 | n/a |
| GPT-5.6 Terra | ~$0.048 | ~$0.043 | ~$0.021 |
| Gemini 3.1 Pro | ~$0.048 | ~$0.043 | ~$0.021 |
| Mistral Medium 3.5 | ~$0.031 | ~$0.027 | ~$0.013 |
| Qwen3.8 Max | ~$0.027 | ~$0.024 | ~$0.014(仅 batch) |
| Grok 4.6 | ~$0.027 | ~$0.023 | ~$0.018(batch −20%) |
| Claude Haiku 4.5 | ~$0.021 | ~$0.018 | ~$0.009 |
| Gemini 3.7 Flash | ~$0.015 | ~$0.013 | ~$0.0067 |
| Kimi K2.5 | ~$0.012 | n/a | ~$0.0074(batch −40%) |
| Gemini 3.5 Flash-Lite | ~$0.0097 | ~$0.0088 | ~$0.0044 |
| DeepSeek V4 Pro(off-peak) | ~$0.0089 | ~$0.0070 | n/a |
| Mistral Large 3 | ~$0.0068 | ~$0.0054 | ~$0.0027 |
| GPT-5.6 Luna | ~$0.0048 | ~$0.0043 | ~$0.0021 |
| DeepSeek V4 Flash(off-peak) | ~$0.003 | ~$0.0023 | n/a |
| Mistral Small 4 | ~$0.0026 | ~$0.0021 | ~$0.0011 |
| Qwen3.7 Flash | ~$0.00055 | n/a | ~$0.00027 |
像 Luna、Gemini Flash-Lite 或 Haiku 这样的低价档,按标价能把一篇文章压到一到两美分。Qwen3.7 Flash 落在大约二十分之一美分 — 这是新的价格下限,因为 DeepSeek 这次调价把它挤出了原来的位置。GPT-5.5 Pro 这样的真旗舰,成本大约是 Qwen Flash 的 1,300×,是 Sonnet 5、GPT-5.6 Terra 这类中端档的 12–15×。
真正能用上的折扣
对任何规模化产出 AI 内容的人来说,有两个机制值得关注 — 这个月它们的附加条件又变多了:
- Prompt caching。Anthropic、OpenAI、Google、xAI、DeepSeek、Alibaba、Moonshot 和 Mistral 都对缓存 input 的读取给折扣 — 通常是 90% 的减免(Anthropic、OpenAI、Google、Mistral、Moonshot)、75%(xAI),DeepSeek 即使在 8 月的调价之后依然接近 97%,其 cache-hit 价格仍是本页面上单项杠杆最大的一条。代价在另一头:缓存写入要加价(Anthropic 对 5 分钟 TTL 收 1.25×,1 小时收 2×;OpenAI 在 GPT-5.6 系列上加了 1.25× 的写入费),而且 Google 还按小时收存储费。只有当缓存前缀确实被重复读取若干次,caching 才划算。
- Batch API。Anthropic、OpenAI、Google、Alibaba 和 Mistral 对 24 小时内完成的异步任务提供 50% 折扣。但它并不是普遍的 50%:xAI 只减 20%,Moonshot 的 batch 价是标价的 60%(−40%,其旗舰 K3 更是完全不在 batch 价格页上),Alibaba 不允许 batch 与 cache 在同一请求上叠加,而 DeepSeek 的折扣看的是时段,不是队列 — 8 月 16 日的调价恢复了错峰/高峰计价,错峰时段(一天中的大部分时间)价格是高峰时段的一半。
两者都存在时可以叠加。Batch + cache 大致能让 input 比标价便宜约 95%、output 便宜 50%。如果你是用固定的系统 prompt、按计划分批生成内容,这两个都该用上。
规模化之后的算术
选一个合理的中端模型 — Claude Sonnet 5 按标价,每篇 $0.062:
| 规模 | 纯 AI(每次重新生成) | AI 出一次模板 + 本地渲染 |
|---|---|---|
| 1 篇 | $0.06 | $0.06 |
| 100 篇 | ~$6.15 | ~$0.06 |
| 1,000 篇 | ~$61.50 | ~$0.06 |
| 10,000 篇 | ~$615 | ~$0.06 |
换成 GPT-5.5 Pro 这样的旗舰,差距还会拉大:10,000 篇按标价约需要 $7,200,而另一边只是生成一个好模板的成本(远低于 $1),再用本地渲染器免费跑。这就是账单不再划算的那一刻。
模型阵容比你的内容计划变得更快
这里还有一项任何价格页都不会列出的成本。本文 2026 年 4 月版里点名的每一个模型 — GPT-5.4、Gemini 3 Flash、Grok 4、DeepSeek V3 与 R1、Qwen3 Max、Mistral Small 3.1、Claude Opus 4.7 与 Sonnet 4.6 — 此后都已被改名、取代或废弃。三个月而已。OpenAI 把数字档位换成了命名档位(Sol / Terra / Luna)。DeepSeek 干脆下线了 deepseek-chat 和 deepseek-reasoner 这两个别名。
7 月版本仅撑了不到一个月。此后:Anthropic 发布了 Claude Opus 5(2026-07-24),表中列出的那个 Opus 就此成为上一代;OpenAI 把 GPT-5.6 Terra 降价 20%、Luna 降价 80%(2026-07-30);Google 相隔五周先后推出了 Gemini 3.6 Flash 与 3.7 Flash;xAI 发布了 Grok 4.6(2026-08-12);Alibaba 用 Qwen3.8 Max 替换了 Qwen3.7 Max(2026-08-03);DeepSeek 在高峰时段把价格最多上调了 1,100%(2026-08-16),重新引入了它随 V4 一代取消的按时段计价。一个月里,七家厂商中有六家改动了价格表。
如果你的内容流水线每次渲染都要调一次模型,上面每一次变动都是一次迁移:新的模型 ID、重新调过的 prompt、重新核算的成本,以及读起来和上个季度不一样的产出。如果你的流水线只调用模型一次来写模板、之后都在本地渲染,这些都与你无关。模型更迭不只是麻烦,它本身就是选择模板路线的理由。
什么时候应该按篇付费
不是每篇文章都是重复品。以下情况,付这份 API 账单是值得的:
- 有独特语气或独特切入角度的一次性编辑稿;
- 你从未覆盖过的新话题,模型需要真的做调研;
- 细腻度比产量更重要的长篇特稿;
- 反正你都会大幅手工编辑的草稿。
这类工作,你要用你负担得起的最好的模型。旗舰档的产出,会用节省下来的编辑时间把成本赚回来。
什么时候应该付一次、渲染很多次
只要你需要产出同一种形态的文章超过几次,成本的算术就会反转:
- 覆盖整个 SKU 目录的产品页;
- 跨语言、跨地区的本地化变体;
- 针对长关键词列表的 SEO 落地页;
- 结构共享的多租户 SaaS 营销站点;
- 任何结构恒定、只有事实在变的场景。
在这里,按次渲染付费纯属浪费。用 AI 把模板写好一次,然后把渲染交给一个免费完成它的工具。
混合工作流
这正是 Spintax 为之而生的工作流:
- 为旗舰付一次费。用你负担得起的最好模型 — Fable 5、Opus 5、GPT-5.6 Sol、Gemini 3.1 Pro — 来撰写模板。你付 $0.05–$1,换来一个高质量、语法安全、多变体的模板。
- 此后永远在本地渲染。Spintax 在你自己的 CPU 上解析模板。成千上万个变体的成本实际为零。
- 只在语义变化时更新。只有当事实或定位发生变化时才重新生成模板 — 而不是在厂商给模型改名时。对一个稳定的产品来说,这大概是一个季度一次。
该花钱的地方为质量付费,不再为数量付费。
注意事项
- 价格会变,名字也会变。上面整张表在 2026 年 4 月到 7 月之间全部翻新了一遍,7 月到 8 月之间又翻新了一次。做预算前请重新核对各家价格页,也绝不要写死一个本季度没有重新验证过的模型 ID。
- 缓存写入不是免费的。标题上那个「90% 折扣」针对的是缓存读取。Anthropic 和 OpenAI 都对写入收溢价,Google 还按小时收存储费。一个只被读取一次的缓存,比不用缓存更贵。
- Batch 并非到处都是 50%。xAI 是 20%。Moonshot 是 40%,且不含其旗舰模型。Alibaba 不允许 batch 与 cache 叠加。DeepSeek 的折扣看的是时段,不是 batch 队列。在核实之前,别假设折扣可以叠加。
- 部分厂商的长上下文要额外收费。Gemini Pro 档位与 Grok 4.6 在超过 200K tokens 后价格大约翻倍。Anthropic 和 OpenAI 在整个上下文窗口内按统一费率计费。
- 各档位的质量并不相同。低价档适合搭骨架和改写。细腻的语气、长上下文的保真度和事实的可靠性,仍然是旗舰的地盘。廉价模型用来做本地渲染,而不是用来写模板本身。
接下来读什么
准备好把一次高质量的 AI 生成变成成千上万次渲染了吗?从写作指南系列开始:
数据来源:Anthropic、OpenAI、Google、xAI、DeepSeek、Alibaba、Moonshot、Mistral 的官方价格页 — 核对于 2026-08-20。单篇成本按每篇 3,000 个 input tokens + 3,500 个 output tokens 计算。