Колькі каштуе кантэнт, які піша AI? Лічбы 2026 года

Мы ўсе прызвычаіліся аддаваць артыкулы AI. У гэтай звычкі ёсць рахунак. Ніжэй — колькі рэальна каштуе адзін артыкул сярэдняга памеру ў асноўных API на жнівень 2026 года і з якога аб’ёму гэты рахунак перастае мець сэнс.

Прайс па спісе

Цэны пазначаны за 1M токенаў у USD, правераны ў жніўні 2026 па афіцыйных старонках правайдараў. За адзін месяц з ліпеньскай рэдакцыі табліца зноў абнавілася — перад бюджэтаваннем пайплайна звярайцеся з прайсамі.

ПравайдарМадэльInputOutput
AnthropicClaude Fable 5 (флагман)$10$50
Claude Opus 5$5$25
Claude Sonnet 5 (сярэдні)$3$15
Claude Haiku 4.5 (бюджэт)$1$5
OpenAIGPT-5.5 Pro (флагман)$30$180
GPT-5.6 Sol$5$30
GPT-5.6 Terra (сярэдні)$2$12
GPT-5.6 Luna (бюджэт)$0.20$1.20
GoogleGemini 3.1 Pro$2.00$12
Gemini 3.7 Flash$0.75$3.75
Gemini 3.5 Flash-Lite$0.30$2.50
xAIGrok 4.6$2$6
Grok 4.3$1.25$2.50
DeepSeekV4 Pro (off-peak)$0.66$1.98
V4 Flash (off-peak)$0.22$0.66
AlibabaQwen3.8 Max$2$6
Qwen3.7 Plus$0.32$1.28
Qwen3.7 Flash$0.03$0.13
MoonshotKimi K3$3$15
Kimi K2.5$0.60$3.00
MistralMedium 3.5$1.50$7.50
Large 3$0.50$1.50
Small 4$0.15$0.60

Mistral — адзіны блок, які не зменіўся за месяц: усе астатнія цэны ў табліцы новыя з ліпеня, і Kimi ад Moonshot трапляе ў табліцу ўпершыню (яе флагман K3 дакладна супадае з цаной Claude Sonnet 5). Output каштуе ў 2–6 разоў даражэй за input на любым узроўні. Гэта важна: доўгі артыкул — гэта пераважна output-токены. Кароткі брыф з доўгім сістэмным промптам — пераважна input. Зорачак стала больш, чым калі-небудзь: уводны прайс Claude Sonnet 5 ($2/$10) заканчваецца 31 жніўня 2026; Gemini 3.7 Flash таксама на ўводным ($1.50/$7.50 з студзеня 2027); у Gemini 3.1 Pro і Grok 4.6 цана прыкладна падвойваецца на кантэксце звыш 200K токенаў ($4/$18 і $4/$12); DeepSeek тарыфікуецца па гадзінах — у табліцы off-peak, а пікавыя гадзіны (01:00–04:00 і 06:00–10:00 UTC) каштуюць удвая; Qwen3.7 Flash ступеньчаты па даўжыні запыту ($0.03/$0.13 да 32K токенаў, аж да $0.20/$0.80).

Колькі рэальна каштуе адзін артыкул

Артыкул сярэдняга памеру — каля 2500 слоў — укладваецца прыкладна ў 3000 input-токенаў (сістэмны промпт, брыф, інструкцыі па шаблоне, зыходныя матэрыялы) і 3500 output-токенаў (≈2500 слоў). Атрымліваем:

МадэльПрайс-лістЗ кэшам (зніжка на чытанне)Кэш + batch
GPT-5.5 Pro~$0.72n/a~$0.36
Claude Fable 5~$0.21~$0.18~$0.089
GPT-5.6 Sol~$0.12~$0.11~$0.053
Claude Opus 5~$0.10~$0.089~$0.045
Claude Sonnet 5~$0.062~$0.053~$0.027
Kimi K3~$0.062~$0.053n/a
GPT-5.6 Terra~$0.048~$0.043~$0.021
Gemini 3.1 Pro~$0.048~$0.043~$0.021
Mistral Medium 3.5~$0.031~$0.027~$0.013
Qwen3.8 Max~$0.027~$0.024~$0.014 (толькі batch)
Grok 4.6~$0.027~$0.023~$0.018 (batch −20%)
Claude Haiku 4.5~$0.021~$0.018~$0.009
Gemini 3.7 Flash~$0.015~$0.013~$0.0067
Kimi K2.5~$0.012n/a~$0.0074 (batch −40%)
Gemini 3.5 Flash-Lite~$0.0097~$0.0088~$0.0044
DeepSeek V4 Pro (off-peak)~$0.0089~$0.0070n/a
Mistral Large 3~$0.0068~$0.0054~$0.0027
GPT-5.6 Luna~$0.0048~$0.0043~$0.0021
DeepSeek V4 Flash (off-peak)~$0.003~$0.0023n/a
Mistral Small 4~$0.0026~$0.0021~$0.0011
Qwen3.7 Flash~$0.00055n/a~$0.00027

Бюджэтны ўзровень кшталту Luna, Gemini Flash-Lite ці Haiku укладвае артыкул у цэнт-два па прайсе. Qwen3.7 Flash ідзе да дваццатай долі цэнта — гэта новая падлога рынку пасля таго, як жнівеньскае падаражэнне выцесніла DeepSeek з гэтага месца. Сапраўдны флагман кшталту GPT-5.5 Pro — гэта прыкладна ў 1300 разоў даражэй за Qwen Flash і ў 12–15 разоў даражэй за сярэдні ўзровень тыпу Sonnet 5 ці GPT-5.6 Terra.

Зніжкі, якія рэальна працуюць

Два механізмы маюць значэнне для ўсіх, хто гоніць AI-кантэнт у аб’ёме, — і ў гэтым месяцы абодва зноў сталі ўмоўнейшымі:

  • Prompt caching. Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot і Mistral даюць зніжку на чытанне закэшаванага input: звычайна −90% (Anthropic, OpenAI, Google, Mistral, Moonshot), −75% (xAI) і каля −97% у DeepSeek, чыя цана cache-hit нават пасля жнівеньскага падаражэння застаецца самым магутным рычагом на гэтай старонцы. Падвох з іншага боку: запіс у кэш каштуе з нацэнкай (Anthropic бярэ 1.25× пры TTL 5 хвілін і 2× пры гадзінным; OpenAI дадаў нацэнку 1.25× на запіс у сямействе GPT-5.6), а Google бярэ пагадзінную плату за захоўванне. Кэш акупляецца толькі тады, калі закэшаваны прэфікс рэальна перачытваецца некалькі разоў.
  • Batch API. Anthropic, OpenAI, Google, Alibaba і Mistral даюць −50% на async-задачы, якія завяршаюцца на працягу 24 гадзін. Універсальнымі гэтыя 50% быць перасталі: xAI скідае толькі 20%, Moonshot тарыфікуе batch па 60% ад прайсу (−40%, і наогул не ўключае флагманскі K3 ў batch-старонку), Alibaba не дазваляе сумяшчаць batch з кэшам у адным запыце, а ў DeepSeek зніжка — гэта гадзіны, а не чарга: падаражэнне 16 жніўня вярнула пікавы/па-за-пікавы тарыф, дзе off-peak (большая частка сутак) каштуе ўдвая танней за пік.

Там, дзе ёсць абодва механізмы, яны складаюцца. Batch + кэш — гэта прыкладна −95% на input і −50% на output адносна прайсу. Калі вы гоніце кантэнт планавымі пачкамі з фіксаваным сістэмным промптам, трэба выкарыстоўваць і тое і другое.

Матэматыка на аб’ёме

Возьмем разумны сярэдні ўзровень — Claude Sonnet 5 па прайсе, $0.062 за артыкул:

Аб’ёмPure-AI (генерым кожны нанава)AI-шаблон адзін раз + лакальны рэндэр
1 артыкул$0.06$0.06
100 артыкулаў~$6.15~$0.06
1 000 артыкулаў~$61.50~$0.06
10 000 артыкулаў~$615~$0.06

Супраць флагмана кшталту GPT-5.5 Pro разрыў большы: 10 000 артыкулаў абыдуцца прыкладна ў $7 200 па прайсе супраць кошту адной якаснай генерацыі шаблона (прыкметна менш за $1) і бясплатнага лакальнага рэндэра. Вось момант, калі рахунак перастае мець сэнс.

Мадэльны рад мяняецца хутчэй за ваш кантэнт-план

Ёсць яшчэ адзін артыкул выдаткаў, якога няма ні ў адным прайсе. Кожная мадэль з красавіцкай рэдакцыі гэтага артыкула — GPT-5.4, Gemini 3 Flash, Grok 4, DeepSeek V3 і R1, Qwen3 Max, Mistral Small 3.1, Claude Opus 4.7 і Sonnet 4.6 — з таго часу перайменавана, заменена наступным пакаленнем ці аб’яўлена састарэлай. Тры месяцы. OpenAI адмовіўся ад лічбавых узроўняў на карысць названых (Sol / Terra / Luna). DeepSeek проста зняў з падтрымкі аліасы deepseek-chat і deepseek-reasoner.

Ліпеньская рэдакцыя пражыла толькі месяц. З таго часу: Anthropic выпусціў Claude Opus 5 (24.07.2026), і Opus з той табліцы стаў папярэднім пакаленнем; OpenAI зрэзаў GPT-5.6 Terra на 20%, а Luna на 80% (30.07.2026); Google выпусціў Gemini 3.6 Flash, а праз пяць тыдняў — 3.7 Flash; xAI выкаціў Grok 4.6 (12.08.2026); Alibaba замяніла Qwen3.7 Max на Qwen3.8 Max (03.08.2026); DeepSeek падняў цэны да +1100% у піку (16.08.2026), вярнуўшы тарыфікацыю па часе сутак, ад якой сам жа адмовіўся з прыходам V4. Адзін месяц — і ў шасці з сямі правайдараў новы прайс.

Калі ваш пайплайн кліча мадэль на кожны рэндэр, любая з гэтых змен — гэта міграцыя: новыя ID мадэляў, пераналадка промптаў, пералік бюджэту і тэкст, які чытаецца не так, як у мінулым квартале. Калі пайплайн кліча мадэль адзін раз, каб напісаць шаблон, а далей рэндэрыць лакальна — вас гэта не датычыцца ўвогуле. Хуткасць змены мадэляў — гэта аргумент на карысць шаблона, а не проста нязручнасць.

Калі лагічна плаціць за кожны артыкул

Не кожны артыкул — паўтор. Плаціць за кожную генерацыю разумна, калі гэта:

  • рэдакцыйныя тэксты з унікальным голасам ці ракурсам;
  • новыя тэмы, у якіх мадэль рэальна «праводзіць даследаванне»;
  • лонгрыды, дзе нюанс важнейшы за аб’ём;
  • чарнавікі, якія вы ўсё роўна будзеце моцна рэдагаваць рукамі.

Для такой працы патрэбны найлепшы даступны вам узровень мадэлі. Якасць флагмана акупляецца эканоміяй часу на рэдактуры.

Калі плаціць адзін раз і рэндэрыць шмат

Эканоміка разварочваецца ў момант, калі вам трэба выдаваць адну і тую ж форму артыкула больш за некалькі разоў:

  • старонкі тавараў па каталогу SKU;
  • лакалізаваныя варыянты па мовах і рэгіёнах;
  • SEO-лендынгі пад доўгі спіс ключоў;
  • multi-tenant SaaS-маркетынг з агульнай структурай;
  • усё, дзе структура сталая, а мяняюцца толькі факты.

Тут плаціць за кожны рэндэр — чыстыя страты. Шаблон пішацца адзін раз з AI, рэндэр ідзе ў інструмент, які робіць гэта бясплатна.

Гібрыдны workflow

Менавіта пад гэты сцэнарый зроблены Spintax:

  1. Заплаціць флагману адзін раз. Бераце найлепшую даступную мадэль — Fable 5, Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro — для напісання шаблона. Плаціце $0.05–$1 і атрымліваеце якасны, граматычна бяспечны, мультыварыянтны шаблон.
  2. Рэндэрыце бясконца — лакальна. Spintax разгортвае шаблон на вашым CPU. Тысячы варыянтаў каштуюць практычна нуль.
  3. Абнаўляеце шаблон, калі мяняецца сэнс. Перагенеруйце толькі калі мяняюцца факты ці пазіцыянаванне, — а не калі вендар перайменаваў мадэль. Для стабільнага прадукту — раз на квартал.

Плаціце за якасць там, дзе яна важная. Перастаяце плаціць за колькасць.

Агаворкі

  • Мяняюцца і цэны, і назвы. Табліца вышэй абнавілася цалкам паміж красавіком і ліпенем 2026 — і зноў паміж ліпенем і жніўнем. Звярайцеся з прайсамі перад бюджэтаваннем і ніколі не зашывайце ў код ID мадэлі, які вы не пераправерылі ў гэтым квартале.
  • Запіс у кэш не бясплатны. Загалоўныя «−90%» датычацца чытання кэшу. Anthropic і OpenAI бяруць нацэнку за запіс, Google — пагадзінную плату за захоўванне. Кэш, які прачыталі адзін раз, даражэйшы, чым адсутнасць кэшу.
  • Batch — не ўсюды 50%. У xAI — 20%. У Moonshot — 40%, і флагман выключаны. Alibaba не сумяшчае batch з кэшам. У DeepSeek зніжка — гэта час сутак, а не batch-чарга. Не лічыце стэк зніжак, пакуль не праверылі.
  • Доўгі кантэкст у часткі правайдараў даражэйшы. У Gemini Pro і Grok 4.6 цана прыкладна падвойваецца пасля 200K токенаў. Anthropic і OpenAI трымаюць плоскі тарыф па ўсім кантэкстным акне.
  • Якасць розная на розных узроўнях. Бюджэтныя мадэлі нармальныя для шкілетаў і перапісванняў. Тонкі голас, long-context і фактычная дакладнасць — усё яшчэ тэрыторыя флагманаў. Выкарыстоўвайце танныя мадэлі для лакальнага рэндэра, а не для самога шаблона.

Што чытаць далей

Гатовы ператварыць адну добрую AI-генерацыю ў тысячы рэндэраў? Пачніце з серыі гайдаў па аўтарынгу:

Крыніцы даных: старонкі цэн Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot, Mistral — праверана 2026-08-20. Разлік «на артыкул» зроблены з 3000 input + 3500 output токенаў.