Колькі каштуе кантэнт, які піша AI? Лічбы 2026 года
Мы ўсе прызвычаіліся аддаваць артыкулы AI. У гэтай звычкі ёсць рахунак. Ніжэй — колькі рэальна каштуе адзін артыкул сярэдняга памеру ў асноўных API на жнівень 2026 года і з якога аб’ёму гэты рахунак перастае мець сэнс.
Прайс па спісе
Цэны пазначаны за 1M токенаў у USD, правераны ў жніўні 2026 па афіцыйных старонках правайдараў. За адзін месяц з ліпеньскай рэдакцыі табліца зноў абнавілася — перад бюджэтаваннем пайплайна звярайцеся з прайсамі.
| Правайдар | Мадэль | Input | Output |
|---|---|---|---|
| Anthropic | Claude Fable 5 (флагман) | $10 | $50 |
| Claude Opus 5 | $5 | $25 | |
| Claude Sonnet 5 (сярэдні) | $3 | $15 | |
| Claude Haiku 4.5 (бюджэт) | $1 | $5 | |
| OpenAI | GPT-5.5 Pro (флагман) | $30 | $180 |
| GPT-5.6 Sol | $5 | $30 | |
| GPT-5.6 Terra (сярэдні) | $2 | $12 | |
| GPT-5.6 Luna (бюджэт) | $0.20 | $1.20 | |
| Gemini 3.1 Pro | $2.00 | $12 | |
| Gemini 3.7 Flash | $0.75 | $3.75 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | |
| xAI | Grok 4.6 | $2 | $6 |
| Grok 4.3 | $1.25 | $2.50 | |
| DeepSeek | V4 Pro (off-peak) | $0.66 | $1.98 |
| V4 Flash (off-peak) | $0.22 | $0.66 | |
| Alibaba | Qwen3.8 Max | $2 | $6 |
| Qwen3.7 Plus | $0.32 | $1.28 | |
| Qwen3.7 Flash | $0.03 | $0.13 | |
| Moonshot | Kimi K3 | $3 | $15 |
| Kimi K2.5 | $0.60 | $3.00 | |
| Mistral | Medium 3.5 | $1.50 | $7.50 |
| Large 3 | $0.50 | $1.50 | |
| Small 4 | $0.15 | $0.60 |
Mistral — адзіны блок, які не зменіўся за месяц: усе астатнія цэны ў табліцы новыя з ліпеня, і Kimi ад Moonshot трапляе ў табліцу ўпершыню (яе флагман K3 дакладна супадае з цаной Claude Sonnet 5). Output каштуе ў 2–6 разоў даражэй за input на любым узроўні. Гэта важна: доўгі артыкул — гэта пераважна output-токены. Кароткі брыф з доўгім сістэмным промптам — пераважна input. Зорачак стала больш, чым калі-небудзь: уводны прайс Claude Sonnet 5 ($2/$10) заканчваецца 31 жніўня 2026; Gemini 3.7 Flash таксама на ўводным ($1.50/$7.50 з студзеня 2027); у Gemini 3.1 Pro і Grok 4.6 цана прыкладна падвойваецца на кантэксце звыш 200K токенаў ($4/$18 і $4/$12); DeepSeek тарыфікуецца па гадзінах — у табліцы off-peak, а пікавыя гадзіны (01:00–04:00 і 06:00–10:00 UTC) каштуюць удвая; Qwen3.7 Flash ступеньчаты па даўжыні запыту ($0.03/$0.13 да 32K токенаў, аж да $0.20/$0.80).
Колькі рэальна каштуе адзін артыкул
Артыкул сярэдняга памеру — каля 2500 слоў — укладваецца прыкладна ў 3000 input-токенаў (сістэмны промпт, брыф, інструкцыі па шаблоне, зыходныя матэрыялы) і 3500 output-токенаў (≈2500 слоў). Атрымліваем:
| Мадэль | Прайс-ліст | З кэшам (зніжка на чытанне) | Кэш + batch |
|---|---|---|---|
| GPT-5.5 Pro | ~$0.72 | n/a | ~$0.36 |
| Claude Fable 5 | ~$0.21 | ~$0.18 | ~$0.089 |
| GPT-5.6 Sol | ~$0.12 | ~$0.11 | ~$0.053 |
| Claude Opus 5 | ~$0.10 | ~$0.089 | ~$0.045 |
| Claude Sonnet 5 | ~$0.062 | ~$0.053 | ~$0.027 |
| Kimi K3 | ~$0.062 | ~$0.053 | n/a |
| GPT-5.6 Terra | ~$0.048 | ~$0.043 | ~$0.021 |
| Gemini 3.1 Pro | ~$0.048 | ~$0.043 | ~$0.021 |
| Mistral Medium 3.5 | ~$0.031 | ~$0.027 | ~$0.013 |
| Qwen3.8 Max | ~$0.027 | ~$0.024 | ~$0.014 (толькі batch) |
| Grok 4.6 | ~$0.027 | ~$0.023 | ~$0.018 (batch −20%) |
| Claude Haiku 4.5 | ~$0.021 | ~$0.018 | ~$0.009 |
| Gemini 3.7 Flash | ~$0.015 | ~$0.013 | ~$0.0067 |
| Kimi K2.5 | ~$0.012 | n/a | ~$0.0074 (batch −40%) |
| Gemini 3.5 Flash-Lite | ~$0.0097 | ~$0.0088 | ~$0.0044 |
| DeepSeek V4 Pro (off-peak) | ~$0.0089 | ~$0.0070 | n/a |
| Mistral Large 3 | ~$0.0068 | ~$0.0054 | ~$0.0027 |
| GPT-5.6 Luna | ~$0.0048 | ~$0.0043 | ~$0.0021 |
| DeepSeek V4 Flash (off-peak) | ~$0.003 | ~$0.0023 | n/a |
| Mistral Small 4 | ~$0.0026 | ~$0.0021 | ~$0.0011 |
| Qwen3.7 Flash | ~$0.00055 | n/a | ~$0.00027 |
Бюджэтны ўзровень кшталту Luna, Gemini Flash-Lite ці Haiku укладвае артыкул у цэнт-два па прайсе. Qwen3.7 Flash ідзе да дваццатай долі цэнта — гэта новая падлога рынку пасля таго, як жнівеньскае падаражэнне выцесніла DeepSeek з гэтага месца. Сапраўдны флагман кшталту GPT-5.5 Pro — гэта прыкладна ў 1300 разоў даражэй за Qwen Flash і ў 12–15 разоў даражэй за сярэдні ўзровень тыпу Sonnet 5 ці GPT-5.6 Terra.
Зніжкі, якія рэальна працуюць
Два механізмы маюць значэнне для ўсіх, хто гоніць AI-кантэнт у аб’ёме, — і ў гэтым месяцы абодва зноў сталі ўмоўнейшымі:
- Prompt caching. Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot і Mistral даюць зніжку на чытанне закэшаванага input: звычайна −90% (Anthropic, OpenAI, Google, Mistral, Moonshot), −75% (xAI) і каля −97% у DeepSeek, чыя цана cache-hit нават пасля жнівеньскага падаражэння застаецца самым магутным рычагом на гэтай старонцы. Падвох з іншага боку: запіс у кэш каштуе з нацэнкай (Anthropic бярэ 1.25× пры TTL 5 хвілін і 2× пры гадзінным; OpenAI дадаў нацэнку 1.25× на запіс у сямействе GPT-5.6), а Google бярэ пагадзінную плату за захоўванне. Кэш акупляецца толькі тады, калі закэшаваны прэфікс рэальна перачытваецца некалькі разоў.
- Batch API. Anthropic, OpenAI, Google, Alibaba і Mistral даюць −50% на async-задачы, якія завяршаюцца на працягу 24 гадзін. Універсальнымі гэтыя 50% быць перасталі: xAI скідае толькі 20%, Moonshot тарыфікуе batch па 60% ад прайсу (−40%, і наогул не ўключае флагманскі K3 ў batch-старонку), Alibaba не дазваляе сумяшчаць batch з кэшам у адным запыце, а ў DeepSeek зніжка — гэта гадзіны, а не чарга: падаражэнне 16 жніўня вярнула пікавы/па-за-пікавы тарыф, дзе off-peak (большая частка сутак) каштуе ўдвая танней за пік.
Там, дзе ёсць абодва механізмы, яны складаюцца. Batch + кэш — гэта прыкладна −95% на input і −50% на output адносна прайсу. Калі вы гоніце кантэнт планавымі пачкамі з фіксаваным сістэмным промптам, трэба выкарыстоўваць і тое і другое.
Матэматыка на аб’ёме
Возьмем разумны сярэдні ўзровень — Claude Sonnet 5 па прайсе, $0.062 за артыкул:
| Аб’ём | Pure-AI (генерым кожны нанава) | AI-шаблон адзін раз + лакальны рэндэр |
|---|---|---|
| 1 артыкул | $0.06 | $0.06 |
| 100 артыкулаў | ~$6.15 | ~$0.06 |
| 1 000 артыкулаў | ~$61.50 | ~$0.06 |
| 10 000 артыкулаў | ~$615 | ~$0.06 |
Супраць флагмана кшталту GPT-5.5 Pro разрыў большы: 10 000 артыкулаў абыдуцца прыкладна ў $7 200 па прайсе супраць кошту адной якаснай генерацыі шаблона (прыкметна менш за $1) і бясплатнага лакальнага рэндэра. Вось момант, калі рахунак перастае мець сэнс.
Мадэльны рад мяняецца хутчэй за ваш кантэнт-план
Ёсць яшчэ адзін артыкул выдаткаў, якога няма ні ў адным прайсе. Кожная мадэль з красавіцкай рэдакцыі гэтага артыкула — GPT-5.4, Gemini 3 Flash, Grok 4, DeepSeek V3 і R1, Qwen3 Max, Mistral Small 3.1, Claude Opus 4.7 і Sonnet 4.6 — з таго часу перайменавана, заменена наступным пакаленнем ці аб’яўлена састарэлай. Тры месяцы. OpenAI адмовіўся ад лічбавых узроўняў на карысць названых (Sol / Terra / Luna). DeepSeek проста зняў з падтрымкі аліасы deepseek-chat і deepseek-reasoner.
Ліпеньская рэдакцыя пражыла толькі месяц. З таго часу: Anthropic выпусціў Claude Opus 5 (24.07.2026), і Opus з той табліцы стаў папярэднім пакаленнем; OpenAI зрэзаў GPT-5.6 Terra на 20%, а Luna на 80% (30.07.2026); Google выпусціў Gemini 3.6 Flash, а праз пяць тыдняў — 3.7 Flash; xAI выкаціў Grok 4.6 (12.08.2026); Alibaba замяніла Qwen3.7 Max на Qwen3.8 Max (03.08.2026); DeepSeek падняў цэны да +1100% у піку (16.08.2026), вярнуўшы тарыфікацыю па часе сутак, ад якой сам жа адмовіўся з прыходам V4. Адзін месяц — і ў шасці з сямі правайдараў новы прайс.
Калі ваш пайплайн кліча мадэль на кожны рэндэр, любая з гэтых змен — гэта міграцыя: новыя ID мадэляў, пераналадка промптаў, пералік бюджэту і тэкст, які чытаецца не так, як у мінулым квартале. Калі пайплайн кліча мадэль адзін раз, каб напісаць шаблон, а далей рэндэрыць лакальна — вас гэта не датычыцца ўвогуле. Хуткасць змены мадэляў — гэта аргумент на карысць шаблона, а не проста нязручнасць.
Калі лагічна плаціць за кожны артыкул
Не кожны артыкул — паўтор. Плаціць за кожную генерацыю разумна, калі гэта:
- рэдакцыйныя тэксты з унікальным голасам ці ракурсам;
- новыя тэмы, у якіх мадэль рэальна «праводзіць даследаванне»;
- лонгрыды, дзе нюанс важнейшы за аб’ём;
- чарнавікі, якія вы ўсё роўна будзеце моцна рэдагаваць рукамі.
Для такой працы патрэбны найлепшы даступны вам узровень мадэлі. Якасць флагмана акупляецца эканоміяй часу на рэдактуры.
Калі плаціць адзін раз і рэндэрыць шмат
Эканоміка разварочваецца ў момант, калі вам трэба выдаваць адну і тую ж форму артыкула больш за некалькі разоў:
- старонкі тавараў па каталогу SKU;
- лакалізаваныя варыянты па мовах і рэгіёнах;
- SEO-лендынгі пад доўгі спіс ключоў;
- multi-tenant SaaS-маркетынг з агульнай структурай;
- усё, дзе структура сталая, а мяняюцца толькі факты.
Тут плаціць за кожны рэндэр — чыстыя страты. Шаблон пішацца адзін раз з AI, рэндэр ідзе ў інструмент, які робіць гэта бясплатна.
Гібрыдны workflow
Менавіта пад гэты сцэнарый зроблены Spintax:
- Заплаціць флагману адзін раз. Бераце найлепшую даступную мадэль — Fable 5, Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro — для напісання шаблона. Плаціце $0.05–$1 і атрымліваеце якасны, граматычна бяспечны, мультыварыянтны шаблон.
- Рэндэрыце бясконца — лакальна. Spintax разгортвае шаблон на вашым CPU. Тысячы варыянтаў каштуюць практычна нуль.
- Абнаўляеце шаблон, калі мяняецца сэнс. Перагенеруйце толькі калі мяняюцца факты ці пазіцыянаванне, — а не калі вендар перайменаваў мадэль. Для стабільнага прадукту — раз на квартал.
Плаціце за якасць там, дзе яна важная. Перастаяце плаціць за колькасць.
Агаворкі
- Мяняюцца і цэны, і назвы. Табліца вышэй абнавілася цалкам паміж красавіком і ліпенем 2026 — і зноў паміж ліпенем і жніўнем. Звярайцеся з прайсамі перад бюджэтаваннем і ніколі не зашывайце ў код ID мадэлі, які вы не пераправерылі ў гэтым квартале.
- Запіс у кэш не бясплатны. Загалоўныя «−90%» датычацца чытання кэшу. Anthropic і OpenAI бяруць нацэнку за запіс, Google — пагадзінную плату за захоўванне. Кэш, які прачыталі адзін раз, даражэйшы, чым адсутнасць кэшу.
- Batch — не ўсюды 50%. У xAI — 20%. У Moonshot — 40%, і флагман выключаны. Alibaba не сумяшчае batch з кэшам. У DeepSeek зніжка — гэта час сутак, а не batch-чарга. Не лічыце стэк зніжак, пакуль не праверылі.
- Доўгі кантэкст у часткі правайдараў даражэйшы. У Gemini Pro і Grok 4.6 цана прыкладна падвойваецца пасля 200K токенаў. Anthropic і OpenAI трымаюць плоскі тарыф па ўсім кантэкстным акне.
- Якасць розная на розных узроўнях. Бюджэтныя мадэлі нармальныя для шкілетаў і перапісванняў. Тонкі голас, long-context і фактычная дакладнасць — усё яшчэ тэрыторыя флагманаў. Выкарыстоўвайце танныя мадэлі для лакальнага рэндэра, а не для самога шаблона.
Што чытаць далей
Гатовы ператварыць адну добрую AI-генерацыю ў тысячы рэндэраў? Пачніце з серыі гайдаў па аўтарынгу:
Крыніцы даных: старонкі цэн Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot, Mistral — праверана 2026-08-20. Разлік «на артыкул» зроблены з 3000 input + 3500 output токенаў.