İçerik için yapay zekâya ödemek: 2026’da gerçek maliyet

Hepimiz makaleleri yapay zekâya devretmeye alıştık. Bu alışkanlığın bir faturası var. İşte Ağustos 2026 itibarıyla orta uzunlukta bir makalenin başlıca API’lerde gerçekte kaça mal olduğu — ve o faturanın anlamını yitirdiği an.

Liste fiyatı

Fiyatlar 1M token başına USD cinsindendir ve Ağustos 2026’da sağlayıcıların fiyat sayfalarına karşı doğrulanmıştır. Temmuz sayımızdan bu yana geçen tek bir ayda tablo yeniden değişti — bir pipeline’ın bütçesini çıkarmadan önce sağlayıcı sayfalarını kontrol edin.

SağlayıcıModelInputOutput
AnthropicClaude Fable 5 (amiral gemisi)$10$50
Claude Opus 5$5$25
Claude Sonnet 5 (orta seviye)$3$15
Claude Haiku 4.5 (ekonomik)$1$5
OpenAIGPT-5.5 Pro (amiral gemisi)$30$180
GPT-5.6 Sol$5$30
GPT-5.6 Terra (orta seviye)$2$12
GPT-5.6 Luna (ekonomik)$0.20$1.20
GoogleGemini 3.1 Pro$2.00$12
Gemini 3.7 Flash$0.75$3.75
Gemini 3.5 Flash-Lite$0.30$2.50
xAIGrok 4.6$2$6
Grok 4.3$1.25$2.50
DeepSeekV4 Pro (off-peak)$0.66$1.98
V4 Flash (off-peak)$0.22$0.66
AlibabaQwen3.8 Max$2$6
Qwen3.7 Plus$0.32$1.28
Qwen3.7 Flash$0.03$0.13
MoonshotKimi K3$3$15
Kimi K2.5$0.60$3.00
MistralMedium 3.5$1.50$7.50
Large 3$0.50$1.50
Small 4$0.15$0.60

Mistral bu ay değişmeyen tek blok — yukarıdaki diğer tüm sağlayıcı fiyatları Temmuz’dan bu yana yeni, ve Moonshot’un Kimi’si tabloya ilk kez katılıyor (amiral gemisi K3, tam olarak Claude Sonnet 5’in fiyatına oturuyor). Her kademede output, input’tan 2–6× daha pahalı. Bunun bir sonucu var: uzun bir makale ağırlıklı olarak output token’dır. Uzun bir sistem prompt’u olan kısa bir brief ise ağırlıklı olarak input’tur. Manşet rakamların üzerinde her zamankinden fazla dipnot var — Claude Sonnet 5’in tanıtım fiyatı ($2/$10) 2026-08-31’de sona eriyor; Gemini 3.7 Flash de tanıtım fiyatındadır ($1.50/$7.50, Ocak 2027’den itibaren); Gemini 3.1 Pro ve Grok 4.6, 200K token’lık bağlamın üzerinde kabaca ikiye katlanır ($4/$18 ve $4/$12); DeepSeek saate göre fiyatlandırılır — tabloda off-peak gösterilir, yoğun saatler (01:00–04:00 ve 06:00–10:00 UTC) bunu ikiye katlar; Qwen3.7 Flash ise istek uzunluğuna göre kademelidir (32K token altında $0.03/$0.13, en fazla $0.20/$0.80).

Bir makale gerçekte kaça mal oluyor

Orta uzunlukta bir makale — kabaca 2,500 kelime — yaklaşık 3,000 input token (sistem prompt’u, brief, şablon yönergeleri, kaynak materyal) ve 3,500 output token (~2,500 kelime) eder. Bu sayılarla:

ModelMakale başına listeCache ile (okuma indirimi)Cache + batch ile
GPT-5.5 Pro~$0.72n/a~$0.36
Claude Fable 5~$0.21~$0.18~$0.089
GPT-5.6 Sol~$0.12~$0.11~$0.053
Claude Opus 5~$0.10~$0.089~$0.045
Claude Sonnet 5~$0.062~$0.053~$0.027
Kimi K3~$0.062~$0.053n/a
GPT-5.6 Terra~$0.048~$0.043~$0.021
Gemini 3.1 Pro~$0.048~$0.043~$0.021
Mistral Medium 3.5~$0.031~$0.027~$0.013
Qwen3.8 Max~$0.027~$0.024~$0.014 (sadece batch)
Grok 4.6~$0.027~$0.023~$0.018 (batch −20%)
Claude Haiku 4.5~$0.021~$0.018~$0.009
Gemini 3.7 Flash~$0.015~$0.013~$0.0067
Kimi K2.5~$0.012n/a~$0.0074 (batch −40%)
Gemini 3.5 Flash-Lite~$0.0097~$0.0088~$0.0044
DeepSeek V4 Pro (off-peak)~$0.0089~$0.0070n/a
Mistral Large 3~$0.0068~$0.0054~$0.0027
GPT-5.6 Luna~$0.0048~$0.0043~$0.0021
DeepSeek V4 Flash (off-peak)~$0.003~$0.0023n/a
Mistral Small 4~$0.0026~$0.0021~$0.0011
Qwen3.7 Flash~$0.00055n/a~$0.00027

Luna, Gemini Flash-Lite veya Haiku gibi ekonomik bir kademe, liste fiyatıyla makaleyi bir iki sente indirir. Qwen3.7 Flash bir sentin yirmide birine yaklaşır — DeepSeek’in yeniden fiyatlandırması onu bu koltuktan çıkarınca oluşan yeni taban. GPT-5.5 Pro gibi gerçek bir amiral gemisi, Qwen Flash’in kabaca 1,300× maliyetindedir ve Sonnet 5 ya da GPT-5.6 Terra gibi bir orta kademenin 12–15× üzerindedir.

Gerçekten geçerli olan indirimler

Yapay zekâ içeriğini hacimli üretenler için iki mekanizma önemlidir — ve ikisi de bu ay yeniden daha koşullu hale geldi:

  • Prompt caching. Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot ve Mistral’ın tamamı önbelleğe alınmış input okumalarına indirim uygular — tipik olarak %90 (Anthropic, OpenAI, Google, Mistral, Moonshot), %75 (xAI) ve Ağustos’taki yeniden fiyatlandırmadan sonra bile bu sayfadaki en güçlü tek kaldıraç olmaya devam eden cache-hit fiyatıyla DeepSeek’te yaklaşık %97. İşin püf noktası diğer tarafta: cache yazma işlemi ek ücrete tabi (Anthropic 5 dakikalık TTL için 1.25×, bir saatlik için 2× faturalandırır; OpenAI, GPT-5.6 ailesine 1.25× yazma ücreti ekledi) ve Google saatlik depolama ücreti alır. Caching, ancak önbelleğe alınan ön eki birkaç kez gerçekten yeniden okuduğunuzda kendini amorti eder.
  • Batch API. Anthropic, OpenAI, Google, Alibaba ve Mistral, 24 saat içinde tamamlanan asenkron işler için %50 indirim sunuyor. Artık evrensel bir %50 değil: xAI yalnızca %20 indirim uyguluyor, Moonshot toplu işlemi listenin %60’ı üzerinden faturalandırır (%40 indirim, amiral gemisi K3’ü batch sayfasında hiç listelemez), Alibaba aynı istekte batch ile cache’in birleşmesine izin vermiyor ve DeepSeek’in indirimi bir kuyruk değil, saattir — 16 Ağustos’taki yeniden fiyatlandırma peak/off-peak faturalandırmayı geri getirdi; off-peak (günün büyük bölümü) peak oranının yarısı.

İkisinin de bulunduğu yerde bunlar birbirine eklenir. Batch + cache, input’ta liste fiyatına göre kabaca %95, output’ta %50 indirim sağlar. İçeriği sabit bir sistem prompt’uyla planlı partiler halinde üretiyorsanız, ikisini de kullanmalısınız.

Ölçekteki matematik

Makul bir orta kademe model seçelim — liste fiyatıyla Claude Sonnet 5, makale başına $0.062:

HacimSaf yapay zekâ (her seferinde yeniden üret)Bir kez AI şablonu + yerel render’lar
1 makale$0.06$0.06
100 makale~$6.15~$0.06
1,000 makale~$61.50~$0.06
10,000 makale~$615~$0.06

GPT-5.5 Pro gibi bir amiral gemisine karşı fark daha da açılır: 10,000 makale liste fiyatıyla yaklaşık $7,200 tutar; buna karşılık iyi bir şablon üretmenin maliyeti ($1’in çok altında) ve onu yerel bir render’layıcıdan geçirmek bedavadır. Faturanın anlamını yitirdiği an tam da budur.

Model listesi, içerik planınızdan daha hızlı değişiyor

Burada hiçbir fiyat sayfasında görünmeyen ikinci bir maliyet var. Bu makalenin Nisan 2026 sayısında adı geçen her model — GPT-5.4, Gemini 3 Flash, Grok 4, DeepSeek V3 ve R1, Qwen3 Max, Mistral Small 3.1, Claude Opus 4.7 ve Sonnet 4.6 — o günden bu yana yeniden adlandırıldı, yerini yenisine bıraktı veya kullanımdan kaldırıldı. Üç ay. OpenAI sayısal kademeleri bırakıp adlandırılmış kademelere geçti (Sol / Terra / Luna). DeepSeek, deepseek-chat ve deepseek-reasoner takma adlarını tamamen emekliye ayırdı.

Temmuz sayısı ancak bir ay hayatta kaldı. O günden bu yana: Anthropic, Claude Opus 5’i piyasaya sürdü (2026-07-24) ve tabloda listelenen Opus bir önceki nesil haline geldi; OpenAI, GPT-5.6 Terra’yı %20, Luna’yı %80 düşürdü (2026-07-30); Google, Gemini 3.6 Flash’i ve ardından beş hafta sonra 3.7 Flash’i piyasaya sürdü; xAI, Grok 4.6’yı piyasaya sürdü (2026-08-12); Alibaba, Qwen3.7 Max’i Qwen3.8 Max ile değiştirdi (2026-08-03); ve DeepSeek, peak saatlerde fiyatları %1,100’e varan oranda artırarak (2026-08-16) V4 ile bıraktığı gün-içi-saat bazlı faturalandırmayı yeniden getirdi. Bir ay; yedi sağlayıcıdan altısı fiyat listesini değiştirdi.

İçerik pipeline’ınız her render’da bir model çağırıyorsa, bu değişikliklerin her biri bir migrasyondur: yeni model ID’leri, yeniden ayarlanan prompt’lar, yeniden hesaplanan maliyetler ve geçen çeyrektekinden farklı okunan bir çıktı. Pipeline’ınız bir şablon yazmak için modeli bir kez çağırıp sonra yerel olarak render alıyorsa, bunların hiçbiri sizi ilgilendirmez. Model sirkülasyonu yalnızca bir rahatsızlık değil, şablon lehine bir argümandır.

Makale başına ne zaman ödemelisiniz

Her makale bir tekrar değildir. API faturasını ödemek şu durumlarda mantıklıdır:

  • kendine özgü bir sesi veya açısı olan tek seferlik editoryal metinler;
  • modelin gerçekten araştırma yaptığı, daha önce hiç ele almadığınız yeni konular;
  • nüansın hacimden daha önemli olduğu uzun soluklu dosyalar;
  • zaten elle yoğun biçimde düzenleyeceğiniz taslaklar.

Bu tür işler için karşılayabileceğiniz en iyi modeli istersiniz. Amiral gemisi kalitesindeki çıktı, azalan düzenleme süresiyle kendini amorti eder.

Ne zaman bir kez ödeyip çok kez render almalısınız

Maliyet matematiği, aynı biçimdeki makaleyi birkaç kereden fazla üretmeniz gerektiği anda tersine döner:

  • bir SKU kataloğu boyunca ürün sayfaları;
  • diller ve bölgeler arasında yerelleştirilmiş varyantlar;
  • uzun bir anahtar kelime listesi için SEO landing sayfaları;
  • yapıyı paylaşan multi-tenant SaaS pazarlama siteleri;
  • yapının sabit, olguların değiştiği her şey.

Burada render başına ödemek düpedüz israftır. Şablonu yapay zekâyla bir kez yazın, ardından render işini bunu bedavaya yapan bir araca devredin.

Hibrit iş akışı

Spintax tam da bu iş akışı için tasarlandı:

  1. Amiral gemisine bir kez ödeyin. Şablonu yazmak için karşılayabileceğiniz en iyi modeli kullanın — Fable 5, Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro. $0.05–$1 ödersiniz ve yüksek kaliteli, dilbilgisi açısından güvenli, çok varyantlı bir şablon elde edersiniz.
  2. Sonsuza kadar, yerel olarak render alın. Spintax şablonu sizin CPU’nuzda çözer. Binlerce varyantın maliyeti fiilen sıfırdır.
  3. Anlam değiştiğinde güncelleyin. Şablonu yalnızca olgular veya konumlandırma değiştiğinde yeniden üretin — sağlayıcı bir modeli yeniden adlandırdığında değil. İstikrarlı bir ürün için bu çeyrekte bir olabilir.

Kaliteye, önemli olduğu yerde ödeme yaparsınız. Miktar için ödeme yapmayı bırakırsınız.

Uyarılar

  • Fiyatlar da adlar da değişir. Yukarıdaki tablonun tamamı Nisan ile Temmuz 2026 arasında yenilendi — ve ardından Temmuz ile Ağustos arasında bir daha yenilendi. Bütçe çıkarmadan önce sağlayıcı sayfalarını yeniden kontrol edin ve bu çeyrekte yeniden doğrulamadığınız bir model ID’sini asla koda gömmeyin.
  • Cache yazmaları bedava değil. Manşetteki “%90 indirim”, cache okumaları için geçerlidir. Anthropic ve OpenAI yazma işlemine ek ücret uygular, Google ise saatlik depolama faturalandırır. Yalnızca bir kez okunan bir cache, hiç cache kullanmamaktan daha pahalıdır.
  • Batch her yerde %50 değil. xAI %20. Moonshot %40 ve amiral gemisini hariç tutuyor. Alibaba, batch ile cache’in birleşmesine izin vermiyor. DeepSeek’in indirimi günün saatidir, bir batch kuyruğu değil. Kontrol etmeden indirim yığınının geçerli olduğunu varsaymayın.
  • Uzun bağlam bazı sağlayıcılarda ekstra maliyetli. Gemini Pro kademeleri ve Grok 4.6, 200K token’ın ötesinde kabaca ikiye katlanır. Anthropic ve OpenAI, bağlam pencereleri boyunca sabit fiyat uygular.
  • Kalite her kademede aynı değil. Ekonomik kademeler iskelet kurma ve yeniden yazma için yeterlidir. Nüanslı bir ses, uzun bağlam sadakati ve olgusal dayanak hâlâ amiral gemisinin işidir. Ucuz modelleri yerel render’lar için kullanın, şablonun kendisi için değil.

Sırada ne var

Tek bir iyi yapay zekâ üretimini binlerce render’a dönüştürmeye hazır mısınız? Yazım serisiyle başlayın:

Not: Bağlantı verilen kılavuz serisi şimdilik yalnızca İngilizce olarak mevcut.

Veri kaynakları: Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot, Mistral fiyat sayfaları — 2026-08-20 tarihinde doğrulandı. Makale başına hesaplamalar, makale başına 3,000 input token + 3,500 output token varsayar.