Model fiyatlarını yan yana koymak neden yanıltıcı — üç gizli çarpan
1 milyon token başına dolar rakamı tek başına hiçbir şey söylemiyor. Tokenizer, uzun bağlam eşiği ve takvimli indirimler hesabı tamamen değiştiriyor.
Bu yazının İngilizcesi: English version.
Bugün beş farklı "AI fiyat rehberi" sitesine baktım ve GPT-5.6 Sol için beş farklı fiyat gördüm. Biri 5 dolar dedi, biri 4, biri "20% indirim yapıldı" dedi ama tarihi yanlış yazdı. Sonunda pes edip üç sağlayıcının kendi dokümanına gittim. Bu yazının bütün rakamları oradan, 25 Temmuz 2026 tarihi itibarıyla.
Ama asıl mesele rakamların yanlış olması değil. Asıl mesele şu: "1 milyon token başına şu kadar dolar" cümlesi tek başına karşılaştırılabilir bir şey değil. Üç tane gizli çarpan var ve üçü de fiyat sayfasının dışında duruyor.
Önce liste fiyatları
Karşılaştırmanın başlangıç noktası. Hepsi 1 milyon token başına dolar, girdi / çıktı:
| Model | Girdi | Önbellek okuma | Çıktı |
|---|---|---|---|
| Claude Fable 5 | 10 | 1,00 | 50 |
| Claude Opus 5 | 5 | 0,50 | 25 |
| Claude Sonnet 5 | 2 | 0,20 | 10 |
| Claude Haiku 4.5 | 1 | 0,10 | 5 |
| GPT-5.6 Sol | 4 | 0,40 | 20 |
| GPT-5.6 Terra | 2 | 0,20 | 12 |
| GPT-5.6 Luna | 0,20 | 0,02 | 1,20 |
| Gemini 3.1 Pro (önizleme) | 2 | — | 12 |
| Gemini 3.7 Flash | 0,75 | 0,075 | 3,75 |
Kaynaklar: Anthropic fiyatlandırma, OpenAI API fiyatlandırma, Gemini API fiyatlandırma.
Buraya bakıp "Sonnet 5 ile Terra aynı fiyat, Gemini 3.1 Pro da aynı" demek çok cazip. Yanlış olur.
Çarpan 1: Tokenizer aynı metni farklı sayıyor
Anthropic'in fiyat sayfasının dibinde, kimsenin okumadığı bir not var. Kendi ifadesiyle: Claude 4.7 ve sonrası yeni bir tokenizer kullanıyor ve bu tokenizer aynı metin için yaklaşık %30 daha fazla token üretiyor.
Bunun ne demek olduğunu bir düşünün. Opus 4.6 da 5 dolar, Opus 5 de 5 dolar. Fiyat listesinde iki satır tıpatıp aynı. Ama aynı PDF'i ikisine verdiğinizde Opus 5 sizden yaklaşık %30 daha fazla token okumuş olacak. Yani aynı işin gerçek fiyatı 5 dolar değil, efektif 6,5 dolar.
Anthropic bunu gizlemiyor, dokümanda açıkça yazıyor ve gerekçesini de veriyor: yeni tokenizer modelin performansına katkı sağlıyor. Muhtemelen doğrudur, hatta token başına daha az düşünme gerektiriyor da olabilir. Ama fiyat karşılaştırması yapan biri için sonuç değişmiyor: liste fiyatı sabit kalırken birim iş pahalılaştı.
Bu, sağlayıcılar arası karşılaştırmayı da bulanıklaştırıyor. Claude ile GPT'nin tokenizer'ları zaten farklı; ikisinin de "1 token"ı aynı miktarda metin demek değil. Kimse iki sağlayıcının aynı belgede kaç token saydığını yan yana yayımlamıyor. Ben de yayımlayamıyorum, çünkü Claude'un tokenizer'ı açık değil. Söyleyebileceğim tek dürüst şey şu: fiyat sayfasındaki sayılar farklı birimlerde ve kimse bunu düzeltmiyor.
Çarpan 2: Uzun bağlam uçurumu
Üç sağlayıcı da 1 milyon civarı bağlam penceresi reklamı yapıyor. Ama o pencerenin içine girdiğinizde ne olduğu tamamen farklı:
| Sağlayıcı | Eşik | Eşiği geçince |
|---|---|---|
| Claude 4.6 ve sonrası | yok | Fiyat değişmiyor. 900 bin token'lık istek, 9 bin token'lık istekle aynı birim fiyattan. |
| GPT-5.6 | 272 bin girdi token | İsteğin tamamı 2x girdi, 1,5x çıktı |
| Gemini 3.1 Pro | 200 bin token | Girdi 2 → 4 dolar, çıktı 12 → 18 dolar |
"İsteğin tamamı" ifadesine dikkat. GPT-5.6'da eşiği bir token geçerseniz ilk 272 bin token da iki kat fiyattan faturalanıyor. Kademeli değil, uçurum.
Aynı işi üç yerde yaptıralım. 300 bin token girdi, 5 bin token çıktı — büyük bir kod tabanını tek seferde okutmak gibi:
| Model | Girdi | Çıktı | Toplam |
|---|---|---|---|
| Claude Haiku 4.5 | 0,300 $ | 0,025 $ | 0,33 $ |
| Claude Sonnet 5 | 0,600 $ | 0,050 $ | 0,65 $ |
| Gemini 3.1 Pro | 1,200 $ | 0,090 $ | 1,29 $ |
| GPT-5.6 Terra | 1,200 $ | 0,090 $ | 1,29 $ |
| Claude Opus 5 | 1,500 $ | 0,125 $ | 1,63 $ |
| GPT-5.6 Sol | 2,400 $ | 0,150 $ | 2,55 $ |
Şimdi aynı modelleri eşiğin altında, 50 bin girdi ve 5 bin çıktı ile karşılaştıralım:
| Model | Toplam |
|---|---|
| Gemini 3.7 Flash | 0,056 $ |
| Claude Haiku 4.5 | 0,075 $ |
| Claude Sonnet 5 | 0,150 $ |
| Gemini 3.1 Pro | 0,160 $ |
| GPT-5.6 Terra | 0,160 $ |
| GPT-5.6 Sol | 0,300 $ |
| Claude Opus 5 | 0,375 $ |
Sıralama değişti. Küçük istekte Sonnet 5 ile Terra ve Gemini 3.1 Pro pratikte aynı yerde; büyük istekte Sonnet 5 diğer ikisinin yarısına düşüyor. Opus 5 küçük istekte listenin en pahalısı, büyük istekte Sol'un altında kalıyor.
Yani "hangisi ucuz" sorusunun cevabı, ne kadar bağlam gönderdiğinize bağlı olarak yer değiştiriyor. Tek bir sıralama yok.
Çarpan 3: Fiyatların son kullanma tarihi var
Bugün gördüğünüz rakamların bir kısmı kalıcı değil. Üçünün de dokümanında tarih yazıyor, ama tabloya bakan kimse dipnota inmiyor:
| Ne | Bugün | Ne zaman değişiyor |
|---|---|---|
| GPT-5.6 Sol | 4 / 20 dolar (tanıtım) | Liste fiyatı 5 / 30 dolar. Tanıtım en az 21 Kasım 2026'ya kadar |
| Gemini 3.7 Flash | 0,75 / 3,75 dolar | 1 Ocak 2027'de 1,50 / 7,50 dolara çıkıyor, iki katı |
| Claude Sonnet 5 | 2 / 10 dolar | Tanıtım fiyatıydı, 1 Eylül 2026'da 3 / 15 dolara çıkacaktı. Zam iptal edildi, bu artık standart fiyat |
Bu üçünü yan yana koyunca ilginç bir tablo çıkıyor: Anthropic planladığı zammı iptal etti, Google zammı takvime bağladı, OpenAI indirimi geçici ilan etti. Aynı çeyrekte üç farklı fiyat stratejisi.
Pratik sonucu şu: dört ay sonrasını hesaplayan bir bütçe yapıyorsanız bugünün fiyatını değil, dipnottaki tarihi kullanın. Gemini 3.7 Flash üzerine kurulmuş bir ürünün maliyeti 1 Ocak'ta ikiye katlanacak ve bu bir sürpriz değil, ilan edilmiş.
Peki ne yapmalı
Kendi kararım şu üç adım oldu:
- Fiyatı değil, işi ölçün. "Şu modelin 1M token'ı kaç dolar" yerine "benim tipik isteğim şu modelde kaç dolar" sorusunu sorun. Tipik isteğinizin girdi/çıktı oranını bilmiyorsanız karşılaştırma yapamazsınız — çünkü çıktı fiyatı girdinin beş katı ve modeller arasında bu oran değişiyor.
- Eşiğin hangi tarafında olduğunuza karar verin. Sürekli 272 binin üstünde çalışacaksanız Claude'un eşiksiz yapısı ciddi bir avantaj. Hep 50 binin altındaysanız bu avantajın hiçbir değeri yok ve Gemini Flash sınıfı sizi çok daha ucuza götürür.
- Önbelleği hesaba katın. Üçünde de önbellek okuması temel girdinin onda biri. Sabit bir sistem promptuyla çalışıyorsanız gerçek faturanız liste fiyatının çok altında olur — ama bunu ancak önbelleği doğru kurgularsanız görürsünüz.
Ve son olarak: bu rakamları üçüncü parti bir "fiyat karşılaştırma" sitesinden almayın. Bugün beş tanesine baktım, beşi de bir yerde yanlıştı. Üç sağlayıcının da fiyat sayfası halka açık ve okuması on dakika sürüyor.
Bu blogda reklam vermek ya da birlikte iş yapmak
MCALAB bağımsız bir stüdyo. Sponsorluk, çapraz tanıtım ya da bir iş birliği için:
ads@mcalab.com.trAyrıntılar: Reklam & iş birliği. Kullanıcı desteği için destek sayfası.