Koliko košta sadržaj koji piše AI? Brojke za 2026.

Svi smo se navikli da članke prepuštamo AI-ju. Ta navika ima račun. Ispod je koliko stvarno košta jedan članak srednje dužine u glavnim API-jima u julu 2026. i od kog obima taj račun prestaje da ima smisla.

Cenovnik po spisku

Cene su za 1M tokena u USD, proverene u julu 2026. na zvaničnim stranicama provajdera. Za tri meseca od aprilskog izdanja tabela se promenila gotovo u celini — pre budžetiranja pajplajna proverite cenovnike.

ProvajderModelInputOutput
AnthropicClaude Fable 5 (flagship)$10$50
Claude Opus 4.8$5$25
Claude Sonnet 5 (srednji)$3$15
Claude Haiku 4.5 (budžetski)$1$5
OpenAIGPT-5.5 Pro (flagship)$30$180
GPT-5.6 Sol$5$30
GPT-5.6 Terra (srednji)$2.50$15
GPT-5.6 Luna (budžetski)$1$6
GoogleGemini 3.1 Pro$2.00$12
Gemini 3.5 Flash$1.50$9
Gemini 3.1 Flash-Lite$0.25$1.50
xAIGrok 4.5$2$6
Grok 4.3$1.25$2.50
DeepSeekV4 Pro$0.44$0.87
V4 Flash$0.14$0.28
AlibabaQwen3.7 Max$2.50$7.50
Qwen3.7 Plus$0.40$1.60
Qwen3.6 Flash$0.25$1.50
MistralMedium 3.5$1.50$7.50
Large 3$0.50$1.50
Small 4$0.15$0.60

Output je 2–6 puta skuplji od inputa na svakom nivou. To je važno: dugačak članak su uglavnom output tokeni. Kratak brif sa dugačkim sistemskim promptom — uglavnom input. Dve cene idu sa zvezdicom: Claude Sonnet 5 ima uvodni cenovnik ($2/$10) do 31. avgusta 2026, a kod Gemini Pro cena se otprilike duplira na kontekstu preko 200K tokena ($4/$18 kod 3.1 Pro) — dugačak kontekst košta više od naslovne cifre.

Koliko stvarno košta jedan članak

Članak srednje dužine — oko 2500 reči — staje u otprilike 3000 input tokena (sistemski prompt, brif, uputstva za šablon, izvorni materijali) i 3500 output tokena (≈2500 reči). Dobijamo:

ModelCenovnikSa kešom (popust na čitanje)Keš + batch
GPT-5.5 Pro~$0.72n/a~$0.36
Claude Fable 5~$0.21~$0.18~$0.089
GPT-5.6 Sol~$0.12~$0.11~$0.053
Claude Opus 4.8~$0.10~$0.089~$0.045
Claude Sonnet 5~$0.062~$0.053~$0.027
GPT-5.6 Terra~$0.060~$0.053~$0.027
Gemini 3.1 Pro~$0.048~$0.043~$0.021
Gemini 3.5 Flash~$0.036~$0.032~$0.016
Qwen3.7 Max~$0.034~$0.030~$0.015
Mistral Medium 3.5~$0.031~$0.027~$0.013
Grok 4.5~$0.027~$0.023~$0.018 (batch −20%)
GPT-5.6 Luna~$0.024~$0.021~$0.011
Claude Haiku 4.5~$0.021~$0.018~$0.009
Mistral Large 3~$0.0068~$0.0054~$0.0027
Gemini 3.1 Flash-Lite~$0.006~$0.0053~$0.0027
DeepSeek V4 Pro~$0.0044~$0.0031n/a
Mistral Small 4~$0.0026~$0.0021~$0.0011
DeepSeek V4 Flash~$0.0014~$0.001n/a

Budžetski nivo poput Haiku, Luna ili Gemini Flash-Lite smešta članak u par centi po cenovniku. DeepSeek V4 Flash ide ka desetinki centa. Pravi flagship poput GPT-5.5 Pro je otprilike 500 puta skuplji od DeepSeeka i otprilike 12 puta skuplji od srednjeg nivoa poput Sonnet 5 ili GPT-5.6 Terra.

Popusti koji stvarno rade

Dva mehanizma su bitna svima koji proizvode AI sadržaj u obimu — ali su oba postala primetno uslovnija nego na proleće:

  • Prompt caching. Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba i Mistral daju popust na čitanje keširanog inputa: obično −90% (Anthropic, OpenAI, Google, Mistral), −75…84% (xAI), −50% (Alibaba) i do −98% kod DeepSeeka, čija je cache-hit cena najmoćnija poluga na ovoj stranici. Kvaka je s druge strane: upis u keš sada košta sa maržom (Anthropic naplaćuje 1.25× pri TTL-u od 5 minuta i 2× pri jednočasovnom; OpenAI je dodao maržu 1.25× na upis u familiji GPT-5.6). Keš se isplati samo kada se keširani prefiks zaista pročita više puta.
  • Batch API. Anthropic, OpenAI, Google, Alibaba i Mistral daju −50% na async zadatke koji se završe u roku od 24 sata. Tih 50% je prestalo da bude univerzalno: xAI spušta samo 20%, a DeepSeek batch popust uopšte ne objavljuje — njegov nekadašnji off-peak prozor (−50…75% po dobu dana) nestao je iz cenovnika zajedno sa generacijom V4.

Tamo gde postoje oba mehanizma, oni se sabiraju. Batch + keš je otprilike −95% na input i −50% na output u odnosu na cenovnik. Ako sadržaj proizvodite planskim serijama sa fiksnim sistemskim promptom, treba koristiti i jedno i drugo.

Matematika u obimu

Uzmimo razuman srednji nivo — Claude Sonnet 5 po cenovniku, $0.062 po članku:

ObimPure-AI (svaki generišemo iznova)AI šablon jednom + lokalni render
1 članak$0.06$0.06
100 članaka~$6.15~$0.06
1 000 članaka~$61.50~$0.06
10 000 članaka~$615~$0.06

Naspram flagshipa poput GPT-5.5 Pro razlika je veća: 10 000 članaka košta oko $7 200 po cenovniku, naspram cene jednog kvalitetnog generisanja šablona (primetno manje od $1) i besplatnog lokalnog rendera. To je trenutak kada račun prestaje da ima smisla.

Ponuda modela se menja brže od vašeg content plana

Postoji još jedna stavka troška koje nema ni u jednom cenovniku. Svaki model iz aprilskog izdanja ovog članka — GPT-5.4, Gemini 3 Flash, Grok 4, DeepSeek V3 i R1, Qwen3 Max, Mistral Small 3.1, Claude Opus 4.7 i Sonnet 4.6 — od tada je preimenovan, zamenjen sledećom generacijom ili proglašen zastarelim. Tri meseca. OpenAI je odustao od brojčanih nivoa u korist imenovanih (Sol / Terra / Luna). DeepSeek je prosto ukinuo alijase deepseek-chat i deepseek-reasoner.

Ako vaš pajplajn poziva model pri svakom renderu, svaka od tih promena je migracija: novi ID-jevi modela, podešavanje promptova iznova, preračunavanje budžeta i tekst koji se ne čita kao prošlog kvartala. Ako pajplajn pozove model jednom, da napiše šablon, a dalje renderuje lokalno — vas se to uopšte ne tiče. Brzina smene modela je argument u korist šablona, a ne samo neprijatnost.

Kada ima smisla plaćati svaki članak

Nije svaki članak ponavljanje. Plaćati svako generisanje razumno je kada su u pitanju:

  • uređivački tekstovi sa jedinstvenim glasom ili uglom;
  • nove teme u kojima model zaista „istražuje“;
  • longridovi gde je nijansa važnija od obima;
  • nacrti koje ćete ionako temeljno doterivati ručno.

Za takav posao vam treba najbolji nivo modela koji vam je dostupan. Kvalitet flagshipa se isplati kroz uštedu vremena na redakturi.

Kada platiti jednom i renderovati mnogo

Ekonomija se obrće u trenutku kada treba da isporučujete isti oblik članka više od nekoliko puta:

  • stranice proizvoda po SKU katalogu;
  • lokalizovane varijante po jezicima i regionima;
  • SEO landing stranice za dugačak spisak ključnih reči;
  • multi-tenant SaaS marketing sa zajedničkom strukturom;
  • sve gde je struktura stalna, a menjaju se samo činjenice.

Tu je plaćanje svakog rendera čist gubitak. Šablon se piše jednom uz AI, a render preuzima alat koji to radi besplatno.

Hibridni radni tok

Upravo za taj scenario je napravljen Spintax:

  1. Platite flagshipu jednom. Uzmete najbolji dostupan model — Fable 5, Opus 4.8, GPT-5.6 Sol, Gemini 3.1 Pro — da napiše šablon. Platite $0.05–$1 i dobijete kvalitetan, gramatički bezbedan, multivarijantan šablon.
  2. Renderujete beskonačno — lokalno. Spintax razvija šablon na vašem CPU-u. Hiljade varijanti koštaju praktično nulu.
  3. Šablon obnavljate kada se promeni suština. Regenerišite samo kada se promene činjenice ili pozicioniranje — a ne kada vendor preimenuje model. Za stabilan proizvod — jednom u kvartalu.

Plaćate kvalitet tamo gde je važan. Prestajete da plaćate količinu.

Ograde

  • Menjaju se i cene i imena. Tabela iznad promenila se u celini između aprila i jula 2026. Proverite cenovnike pre budžetiranja i nikada ne zašivajte u kod ID modela koji niste proverili ovog kvartala.
  • Upis u keš nije besplatan. Naslovnih „−90%“ odnosi se na čitanje keša. Anthropic i OpenAI naplaćuju maržu za upis, Google — skladištenje po satu. Keš pročitan jednom skuplji je od keša koga nema.
  • Batch nije svuda 50%. Kod xAI je 20%. Kod DeepSeeka batch popusta u cenovniku uopšte nema. Ne računajte stek popusta dok ga niste proverili.
  • Dugačak kontekst je kod dela provajdera skuplji. Kod Gemini Pro cena se otprilike duplira posle 200K tokena. Anthropic i OpenAI drže ravnu tarifu preko celog kontekstnog prozora.
  • Kvalitet se razlikuje po nivoima. Budžetski modeli su u redu za skelete i prepisivanja. Istančan glas, long-context i činjenična tačnost i dalje su teritorija flagshipa. Jeftine modele koristite za lokalni render, a ne za sam šablon.

Šta dalje čitati

Spremni da jedno dobro AI generisanje pretvorite u hiljade rendera? Počnite od serije vodiča za pisanje:

Izvori podataka: stranice sa cenama Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Mistral — provereno 2026-07-13. Računica „po članku“ rađena je sa 3000 input + 3500 output tokena.