Koliko košta sadržaj koji piše AI? Brojke za 2026.
Svi smo se navikli da članke prepuštamo AI-ju. Ta navika ima račun. Ispod je koliko stvarno košta jedan članak srednje dužine u glavnim API-jima u avgustu 2026. i od kog obima taj račun prestaje da ima smisla.
Cenovnik po spisku
Cene su za 1M tokena u USD, proverene u avgustu 2026. na zvaničnim stranicama provajdera. Tabela se ponovo promenila — u samo mesec dana od julskog izdanja — pre budžetiranja pajplajna proverite cenovnike provajdera.
| Provajder | Model | Input | Output |
|---|---|---|---|
| Anthropic | Claude Fable 5 (flagship) | $10 | $50 |
| Claude Opus 5 | $5 | $25 | |
| Claude Sonnet 5 (srednji) | $3 | $15 | |
| Claude Haiku 4.5 (budžetski) | $1 | $5 | |
| OpenAI | GPT-5.5 Pro (flagship) | $30 | $180 |
| GPT-5.6 Sol | $5 | $30 | |
| GPT-5.6 Terra (srednji) | $2 | $12 | |
| GPT-5.6 Luna (budžetski) | $0.20 | $1.20 | |
| Gemini 3.1 Pro | $2.00 | $12 | |
| Gemini 3.7 Flash | $0.75 | $3.75 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | |
| xAI | Grok 4.6 | $2 | $6 |
| Grok 4.3 | $1.25 | $2.50 | |
| DeepSeek | V4 Pro (off-peak) | $0.66 | $1.98 |
| V4 Flash (off-peak) | $0.22 | $0.66 | |
| Alibaba | Qwen3.8 Max | $2 | $6 |
| Qwen3.7 Plus | $0.32 | $1.28 | |
| Qwen3.7 Flash | $0.03 | $0.13 | |
| Moonshot | Kimi K3 | $3 | $15 |
| Kimi K2.5 | $0.60 | $3.00 | |
| Mistral | Medium 3.5 | $1.50 | $7.50 |
| Large 3 | $0.50 | $1.50 | |
| Small 4 | $0.15 | $0.60 |
Mistral je jedini blok koji se ovog meseca nije pomerio — cene svih ostalih provajdera iznad su nove od jula, a Moonshotov Kimi se po prvi put pojavljuje u tabeli (njegov flagship K3 je tačno na ceni Claude Sonneta 5). Output je 2–6 puta skuplji od inputa na svakom nivou. To je važno: dugačak članak su uglavnom output tokeni. Kratak brif sa dugačkim sistemskim promptom — uglavnom input. Više fusnota nego ikad prati naslovne brojke — uvodna cena Claude Sonnet 5 ($2/$10) ističe 2026-08-31; Gemini 3.7 Flash je takođe uvodna cena ($1.50/$7.50 od januara 2027.); Gemini 3.1 Pro i Grok 4.6 se otprilike dupliraju preko konteksta od 200K tokena ($4/$18 i $4/$12); DeepSeek se naplaćuje po dobu dana — tabela prikazuje off-peak, a u vršnim satima (01:00–04:00 i 06:00–10:00 UTC) cena se duplira; Qwen3.7 Flash je stepenast po dužini zahteva ($0.03/$0.13 do 32K tokena, do $0.20/$0.80).
Koliko stvarno košta jedan članak
Članak srednje dužine — oko 2500 reči — staje u otprilike 3000 input tokena (sistemski prompt, brif, uputstva za šablon, izvorni materijali) i 3500 output tokena (≈2500 reči). Dobijamo:
| Model | Cenovnik | Sa kešom (popust na čitanje) | Keš + batch |
|---|---|---|---|
| GPT-5.5 Pro | ~$0.72 | n/a | ~$0.36 |
| Claude Fable 5 | ~$0.21 | ~$0.18 | ~$0.089 |
| GPT-5.6 Sol | ~$0.12 | ~$0.11 | ~$0.053 |
| Claude Opus 5 | ~$0.10 | ~$0.089 | ~$0.045 |
| Claude Sonnet 5 | ~$0.062 | ~$0.053 | ~$0.027 |
| Kimi K3 | ~$0.062 | ~$0.053 | n/a |
| GPT-5.6 Terra | ~$0.048 | ~$0.043 | ~$0.021 |
| Gemini 3.1 Pro | ~$0.048 | ~$0.043 | ~$0.021 |
| Mistral Medium 3.5 | ~$0.031 | ~$0.027 | ~$0.013 |
| Qwen3.8 Max | ~$0.027 | ~$0.024 | ~$0.014 (samo batch) |
| Grok 4.6 | ~$0.027 | ~$0.023 | ~$0.018 (batch −20%) |
| Claude Haiku 4.5 | ~$0.021 | ~$0.018 | ~$0.009 |
| Gemini 3.7 Flash | ~$0.015 | ~$0.013 | ~$0.0067 |
| Kimi K2.5 | ~$0.012 | n/a | ~$0.0074 (batch −40%) |
| Gemini 3.5 Flash-Lite | ~$0.0097 | ~$0.0088 | ~$0.0044 |
| DeepSeek V4 Pro (off-peak) | ~$0.0089 | ~$0.0070 | n/a |
| Mistral Large 3 | ~$0.0068 | ~$0.0054 | ~$0.0027 |
| GPT-5.6 Luna | ~$0.0048 | ~$0.0043 | ~$0.0021 |
| DeepSeek V4 Flash (off-peak) | ~$0.003 | ~$0.0023 | n/a |
| Mistral Small 4 | ~$0.0026 | ~$0.0021 | ~$0.0011 |
| Qwen3.7 Flash | ~$0.00055 | n/a | ~$0.00027 |
Budžetski nivo poput Luna, Gemini Flash-Lite ili Haiku smešta članak na cent ili dva po cenovniku. Qwen3.7 Flash spušta se na oko dvadesetinku centa — novo dno, sada kada je DeepSeekovo poskupljenje istisnulo taj model sa tog mesta. Pravi flagship poput GPT-5.5 Pro je otprilike 1300 puta skuplji od Qwen Flasha i 12–15 puta skuplji od srednjeg nivoa poput Sonnet 5 ili GPT-5.6 Terra.
Popusti koji stvarno rade
Dva mehanizma su bitna svima koji proizvode AI sadržaj u obimu — i oba su ovog meseca ponovo postala uslovnija:
- Prompt caching. Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot i Mistral svi daju popust na čitanje keširanog inputa — obično 90% (Anthropic, OpenAI, Google, Mistral, Moonshot), 75% (xAI) i oko 97% kod DeepSeeka, čija je cache-hit cena i dalje najjača poluga na ovoj stranici, čak i posle avgustovskog poskupljenja. Kvaka je s druge strane: upis u keš nosi doplatu (Anthropic naplaćuje 1.25× za TTL od 5 minuta i 2× za jedan sat; OpenAI je dodao doplatu od 1.25× na upis u familiji GPT-5.6), a Google naplaćuje skladištenje po satu. Keš se isplati tek kada se keširani prefiks zaista pročita nekoliko puta.
- Batch API. Anthropic, OpenAI, Google, Alibaba i Mistral daju 50% popusta za async zadatke koji se završe u roku od 24 sata. To nije univerzalnih 50%: xAI daje popust od samo 20%, Moonshot naplaćuje batch po 60% cenovnika (−40%, i svoj flagship K3 uopšte ne navodi na batch stranici), Alibaba ne dozvoljava da se batch i keš kombinuju na istom zahtevu, a kod DeepSeeka popust određuje doba dana, a ne red čekanja — poskupljenje od 16. avgusta vratilo je naplatu po vršnom/vanvršnom periodu, pri čemu je vanvršni period (veći deo dana) upola jeftiniji od vršnog.
Tamo gde postoje oba mehanizma, oni se sabiraju. Batch + keš je otprilike −95% na input i −50% na output u odnosu na cenovnik. Ako sadržaj proizvodite planskim serijama sa fiksnim sistemskim promptom, treba koristiti i jedno i drugo.
Matematika u obimu
Uzmimo razuman srednji nivo — Claude Sonnet 5 po cenovniku, $0.062 po članku:
| Obim | Pure-AI (svaki generišemo iznova) | AI šablon jednom + lokalni render |
|---|---|---|
| 1 članak | $0.06 | $0.06 |
| 100 članaka | ~$6.15 | ~$0.06 |
| 1 000 članaka | ~$61.50 | ~$0.06 |
| 10 000 članaka | ~$615 | ~$0.06 |
Naspram flagshipa poput GPT-5.5 Pro razlika je veća: 10 000 članaka košta oko $7 200 po cenovniku, naspram cene jednog kvalitetnog generisanja šablona (primetno manje od $1) i besplatnog lokalnog rendera. To je trenutak kada račun prestaje da ima smisla.
Ponuda modela se menja brže od vašeg content plana
Postoji još jedna stavka troška koje nema ni u jednom cenovniku. Svaki model iz aprilskog izdanja ovog članka — GPT-5.4, Gemini 3 Flash, Grok 4, DeepSeek V3 i R1, Qwen3 Max, Mistral Small 3.1, Claude Opus 4.7 i Sonnet 4.6 — od tada je preimenovan, zamenjen sledećom generacijom ili proglašen zastarelim. Tri meseca. OpenAI je odustao od brojčanih nivoa u korist imenovanih (Sol / Terra / Luna). DeepSeek je prosto ukinuo alijase deepseek-chat i deepseek-reasoner.
Julsko izdanje je izdržalo jedva mesec dana. Od tada: Anthropic je izbacio Claude Opus 5 (2026-07-24), pa je Opus koji je tabela do tada navodila postao prošla generacija; OpenAI je snizio GPT-5.6 Terra za 20%, a Luna za 80% (2026-07-30); Google je pokrenuo Gemini 3.6 Flash, a pet nedelja kasnije i 3.7 Flash; xAI je izbacio Grok 4.6 (2026-08-12); Alibaba je zamenio Qwen3.7 Max modelom Qwen3.8 Max (2026-08-03); a DeepSeek je podigao cene i do 1100% u vršnim satima (2026-08-16), vrativši naplatu po dobu dana koju je ukinuo sa generacijom V4. Jedan mesec; šest od sedam provajdera promenilo je cenovnik.
Ako vaš pajplajn poziva model pri svakom renderu, svaka od tih promena je migracija: novi ID-jevi modela, podešavanje promptova iznova, preračunavanje budžeta i tekst koji se ne čita kao prošlog kvartala. Ako pajplajn pozove model jednom, da napiše šablon, a dalje renderuje lokalno — vas se to uopšte ne tiče. Brzina smene modela je argument u korist šablona, a ne samo neprijatnost.
Kada ima smisla plaćati svaki članak
Nije svaki članak ponavljanje. Plaćati svako generisanje razumno je kada su u pitanju:
- uređivački tekstovi sa jedinstvenim glasom ili uglom;
- nove teme u kojima model zaista „istražuje“;
- longridovi gde je nijansa važnija od obima;
- nacrti koje ćete ionako temeljno doterivati ručno.
Za takav posao vam treba najbolji nivo modela koji vam je dostupan. Kvalitet flagshipa se isplati kroz uštedu vremena na redakturi.
Kada platiti jednom i renderovati mnogo
Ekonomija se obrće u trenutku kada treba da isporučujete isti oblik članka više od nekoliko puta:
- stranice proizvoda po SKU katalogu;
- lokalizovane varijante po jezicima i regionima;
- SEO landing stranice za dugačak spisak ključnih reči;
- multi-tenant SaaS marketing sa zajedničkom strukturom;
- sve gde je struktura stalna, a menjaju se samo činjenice.
Tu je plaćanje svakog rendera čist gubitak. Šablon se piše jednom uz AI, a render preuzima alat koji to radi besplatno.
Hibridni radni tok
Upravo za taj scenario je napravljen Spintax:
- Platite flagshipu jednom. Uzmete najbolji dostupan model — Fable 5, Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro — da napiše šablon. Platite $0.05–$1 i dobijete kvalitetan, gramatički bezbedan, multivarijantan šablon.
- Renderujete beskonačno — lokalno. Spintax razvija šablon na vašem CPU-u. Hiljade varijanti koštaju praktično nulu.
- Šablon obnavljate kada se promeni suština. Regenerišite samo kada se promene činjenice ili pozicioniranje — a ne kada vendor preimenuje model. Za stabilan proizvod — jednom u kvartalu.
Plaćate kvalitet tamo gde je važan. Prestajete da plaćate količinu.
Ograde
- Menjaju se i cene i imena. Tabela iznad promenila se u celini između aprila i jula 2026, a zatim ponovo između jula i avgusta. Proverite cenovnike pre budžetiranja i nikada ne zašivajte u kod ID modela koji niste proverili ovog kvartala.
- Upis u keš nije besplatan. Naslovnih „−90%“ odnosi se na čitanje keša. Anthropic i OpenAI naplaćuju maržu za upis, Google — skladištenje po satu. Keš pročitan jednom skuplji je od keša koga nema.
- Batch nije svuda 50%. Kod xAI je 20%. Kod Moonshota je 40% i ne obuhvata flagship. Alibaba ne dozvoljava da se batch i keš kombinuju. Kod DeepSeeka popust zavisi od doba dana, a ne od batch reda. Ne računajte stek popusta dok ga niste proverili.
- Dugačak kontekst je kod dela provajdera skuplji. Kod Gemini Pro nivoa i kod Grok 4.6 cena se otprilike duplira posle 200K tokena. Anthropic i OpenAI drže ravnu tarifu preko celog kontekstnog prozora.
- Kvalitet se razlikuje po nivoima. Budžetski modeli su u redu za skelete i prepisivanja. Istančan glas, long-context i činjenična tačnost i dalje su teritorija flagshipa. Jeftine modele koristite za lokalni render, a ne za sam šablon.
Šta dalje čitati
Spremni da jedno dobro AI generisanje pretvorite u hiljade rendera? Počnite od serije vodiča za pisanje:
Izvori podataka: stranice sa cenama Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot, Mistral — provereno 2026-08-20. Računica „po članku“ rađena je sa 3000 input + 3500 output tokena.