Üç sınır API'si, birbirlerini takip eden bir hafta içinde piyasaya sürüldü veya fiyatları yeniden belirlendi ve üç farklı fiyat bandında yer alıyorlar. Google, Gemini 3.8 Flash'i 2 Eylül 2026'da milyon giriş token'ı başına 0,75 dolar ve milyon çıkış token'ı başına 3,75 dolardan piyasaya sürdü. Anthropic, bir gün önce Claude Fable 5.1'i 10 dolar ve 50 dolardan yayınladı. OpenAI'nin GPT-5.6 Sol'u ise 5 dolar ve 30 dolarla bunların arasında yer alıyor. Artificial Analysis'in bağımsız Zeka Endeksi'nde, üçü sırasıyla 59, 57 ve 59 puan alıyor. Tüm karşılaştırma tek bir cümlede özetlenebilir: en üst seviyenin yaklaşık on üçte biri fiyatına sahip bir model, üçünü de aynı şekilde test eden tek bir endekste onunla aynı seviyede puan alıyor.
İşin püf noktası "endeks" kelimesinde yatıyor. Kıyaslamalar görev başına yanıtları sayar. Faturanız görev başına token'ları sayar ve Gemini 3.8 Flash, daha fazla token harcamak üzere tasarlanmıştır. Bu kılavuz, üçünü teknik özellikler, Google'ın kendi kıyaslama tabloları (Fable 5.1'in neden eksik olduğunu açıklıyoruz), Artificial Analysis'in bağımsız rakamları ve fiyat aritmetiği açısından yan yana koyar. Ardından, hangi API'nin hangi iş yüküne uygun olduğuna dair basit bir kural sunar. Gemini 3.8 Flash temel yazısı modeli kendi terimleriyle ele alır ve Google'ın lansman yazısı aşağıdaki her Google iddiasının birincil kaynağıdır.
Zamanlamayla ilgili bir not. Ağustos ayındaki Gemini 3.7 Flash vs Claude vs GPT karşılaştırmamız, Claude Fable 5.1'e değil, Claude Fable 5'e karşı yapılmıştı. Anthropic o modeli 1 Eylül'de değiştirdiği için bu, bir yenileme değil, taze bir eşleştirme.
Teknik özelliklere hızlı bakış
| Gemini 3.8 Flash | Claude Fable 5.1 | GPT-5.6 Sol | |
|---|---|---|---|
| Tedarikçi | Anthropic | OpenAI | |
| Bağlam penceresi | 1.048.576 token | 1M token | 1M token |
| Maksimum çıkış | 65.536 token | 128K token | 128K token |
| Giriş fiyatı (1M başına) | 0,75 $ başlangıç, 1 Ocak 2027'den itibaren 1,50 $ | 10 $ | 5 $ |
| Çıkış fiyatı (1M başına) | 3,75 $ başlangıç, 1 Ocak 2027'den itibaren 7,50 $ | 50 $ | 30 $ |
| Önbellek okuma (1M başına) | 0,075 $ başlangıç, 1 Ocak'tan itibaren 0,15 $ | 0,25 $ | 0,50 $ |
| Bilgi kesme tarihi | Mart 2026 | Haziran 2026 | Burada listelenmemiş |
| Akıl yürütme kontrolü | thinking_level düşük / orta / yüksek (orta varsayılandır) |
Gelişmiş düşünme, her zaman açık | Efor seviyeleri xhigh'a kadar |
| Artificial Analysis endeksi | 59 (yüksek) | 57 (orta) | 59 (xhigh) |
Herhangi bir kıyaslamadan önce iki şey dikkat çekiyor. Gemini 3.8 Flash, diğer ikisinin maksimum çıktısının yarısına sahip, 128K'ya karşı 65.536 token. Bu durum, kısa adımlar yayan aracı döngülerinden çok, tek atımlık uzun belgeler için önemlidir. Ayrıca, tanıtım fiyatı 31 Aralık 2026'da sona eriyor: 1 Ocak'tan itibaren her iki Gemini oranı da iki katına çıkacak ve bu da bu makaledeki her oranı değiştirecek. Gemini 3.8 Flash fiyatlandırma kılavuzu, iki katına çıkma, önbellekleme, toplu işlem ve temel oranları tüm detaylarıyla açıklar.
Bağımsız puan: 59, 57, 59
Artificial Analysis, her model için aynı dokuz değerlendirmeyi yapar ve tek bir Zeka Endeksi puanı yayınlar. Gemini 3.8 Flash, yüksek düşünme seviyesinde 59 puan alırken, 3.7 Flash için 56 ve 3.6 Flash için 52 puandan yükseldi. GPT-5.6 Sol, xhigh efor seviyesinde de 59 puan alıyor. Claude Fable 5.1, orta efor seviyesinde 57 puan alarak GPT-5.6 Terra'nın maksimum ve Muse Spark 1.2'nin xhigh seviyeleriyle aynı sırada yer aldı. Grok 4.6, orta seviyede 59 puan alan diğer bir modeldir.
Sayıları okumadan önce akıl yürütme seviyesi etiketlerini okuyun. Fable 5.1, en yüksek ayarında değil, orta seviyede test edildi ve Sol, en yüksek ayarı olan xhigh'da test edildi. Farklı efor seviyelerinde iki puanlık bir fark bir sıralama değildir ve Artificial Analysis bunu bir nedenle bu şekilde listeliyor. Savunulabilir ifade daha dardır: test edilen ayarlarda, Gemini 3.8 Flash bu endekste iki premium modelle eşleşiyor ve 59 puanla açık ara en ucuz modeldir.
Aynı yazıda bu puanın maliyeti de ölçüldü. Yüksek seviyede Gemini 3.8 Flash, görev başına ortalama 48.000 çıkış token'ı kullandı, bu 3.7 Flash'tan %30 daha fazla; dolayısıyla endeksini çalıştırmanın maliyeti, token başına fiyatlar değişmeden 3.7 Flash'ta görev başına 0,40 $'dan 3.8 Flash'ta 0,58 $'a yükseldi. Orta seviyede görev başına 0,41 $ ve düşük seviyede 0,24 $'dır. Token başına fiyat çok cazip göründüğünde bu rakamları aklınızda bulundurun.
Google'ın kıyaslama tabloları ve eksik olanlar
Google'ın Flash sayfası, metin biçiminde üç satıcılar arası satır yayınlar. Claude Fable 5.1 bunlarda yer almıyor. Google'ın tabloları bunun yerine Anthropic'in Opus 5 ve Sonnet 5'ini içeriyor ve tablolar yayınlandığında Fable 5.1 bir gündür herkese açıktı. Bu nedenle, aşağıdaki Anthropic sütunu, bu makalenin konusu olan 10 $ / 50 $ model değil, Opus 5 (5 $ / 25 $) ve Sonnet 5 (2 $ / 10 $) modelleridir. Bunu doğrudan bir eşleşme olarak değil, mevcut en iyi vekil olarak değerlendirin.
| Kıyaslama (Google tarafından yürütülen) | Gemini 3.8 Flash | Claude Opus 5 | Claude Sonnet 5 | GPT-5.6 Sol | GPT-5.6 Terra |
|---|---|---|---|---|---|
| HLE-Verified | %54,9 | %54,4 | %31,0 | %54,5 | %51,1 |
| Vals Finans Aracısı v2 | %61,4 | %58,6 | %53,9 | %53,8 | %54,4 |
| Harvey Hukuk Aracısı Kıyaslaması | %10,0 | %6,7 | %5,0 | %2,5 | %0,8 |
HLE-Verified'da üçlü bir beraberlik var: 54,9, 54,4 ve 54,5 birbirlerinden yarım puandan daha az farkla yer alırken, Sonnet 5 oldukça geride. Vals Finance Agent v2'de ise 3.8 Flash öne çıkıyor; çok adımlı bir aracı finans görevinde Opus 5'ten 2,8 puan ve Sol'dan 7,6 puan daha yüksek. Harvey Legal ise istisna: her model %11'in altında puan alıyor, bu nedenle sıralama boşluklardan daha fazlasını anlatıyor.
Google'ın metin biçiminde yayınlamadığı bilgiler de aynı derecede önemli. 3.8 Flash için SWE-Bench Pro, Terminal-bench veya OSWorld rakamı bulunmuyor ve DeepSWE v1.1 sonucu yalnızca modelin "çoğu daha büyük sınır modelini" "maliyetin bir kısmıyla" "geride bıraktığı" iddiası olarak, metin yerine bir görsel tabloda yer alıyor. Kodlama ve bilgisayar kullanımı karşılaştırmaları için, birbirini kapsamayacak şekilde her satıcının kendi testlerine bakmanız gerekir. Anthropic'inkiler Claude Fable 5.1 kıyaslamalarının ayrıntılarında; OpenAI'ninkiler ise GPT-5.6 Sol kıyaslamalarında bulunuyor. Hiçbir satıcı diğerinin modelini çalıştırmadığı için, Artificial Analysis karşılaştırılabilir tek kaynak olmaya devam ediyor.
Fiyat farkı, satır satır
Tanıtım fiyatlarında aritmetik açıktır. Fable 5.1'in 10 dolarlık girişi, Gemini 3.8 Flash'ın 0,75 dolarlık girişinin 13,3 katı ve 50 dolarlık çıktısı 3,75 doların 13,3 katıdır. GPT-5.6 Sol'un 5 dolarlık girişi 6,7 katı ve 30 dolarlık çıktısı 8 katıdır. Önbellek okumaları farkı daraltır: 3.8 Flash'ta 0,075 $, Fable 5.1'de 0,25 $ (3,3 kat) ve Sol'da 0,50 $ (6,7 kat). Fable 5.1'in önbellek okuması Sol'unkinin yarısıdır; bu, en pahalı modelin en pahalı olmadığı tek alandır.
Çözümlü bir örnekle somutlaştıralım. Tümünün önbelleğe alınmadığı, 1 milyon giriş token'ı ve 200.000 çıkış token'ı tüketen bir çalışmayı ele alalım.
- Gemini 3.8 Flash: 0,75 $ + 0,75 $ = 1,50 $
- GPT-5.6 Sol: 5,00 $ + 6,00 $ = 11,00 $
- Claude Fable 5.1: 10,00 $ + 10,00 $ = 20,00 $
1 Ocak 2027'den itibaren aynı Gemini çalıştırmasının maliyeti 3,00 $ olacak ve Sol için fark 3,7 katına, Fable 5.1 için ise 6,7 katına sıkışacak. Bu iki katına çıkma 3.6 Flash ve 3.7 Flash için de geçerli, bu nedenle geri çekilecek daha ucuz bir Gemini Flash yok. Anthropic'in fiyatlandırma sayfası Fable 5.1 oranlarını listelerken, Claude Fable 5.1 fiyatlandırma kılavuzumuz ve GPT-5.6 fiyatlandırma kılavuzumuz her birinin toplu iş ve önbellek katmanlarını kapsar.
Token başına değil, görev başına maliyet
İşte o basit matematiği bozan uyarı. Google, Gemini 3.8 Flash'ın "uzun süreli ve karmaşık görevlerde daha fazla token kullanabileceğini, tasarım gereği" belirtiyor. Zor problemlerde daha küçük akıl yürütme adımları atar, işini doğrular ve araçları tekrarlayarak çağırır. Artificial Analysis etkiyi ölçtü: yüksek seviyede görev başına 48.000 çıkış token'ı, 3.7 Flash'tan %30 daha fazla; böylece token başına fiyatlar değişmeden, endeksini çalıştırmanın maliyeti 3.7 Flash'ta görev başına 0,40 $'dan 3.8 Flash'ta 0,58 $'a yükseldi. Orta seviyede görev başına 0,41 $ ve düşük seviyede 0,24 $.
İki sonuç ortaya çıkıyor. Birincisi, premium model daha az token veya daha az araç dönüşüyle tamamlanırsa, token başına 13,3 kat fark, faturada 13,3 kat fark anlamına gelmez. Artificial Analysis, elimizdeki metinde Fable 5.1 veya Sol için benzer bir görev başına rakam yayınlamadığı için, çarpanın herhangi bir yönüne güvenmeden önce bunu kendi istemleriniz üzerinde ölçün. İkincisi, Gemini'de düşünme seviyesi maliyet kaldıraçtır. Artificial Analysis'in setinde bir rotayı yüksekten düşüğe düşürmek, görev başına maliyeti yarıdan fazla azalttı ve düşünme seviyeleri kılavuzu, bunun her uç noktaya nasıl ayarlanacağını gösteriyor. 3.8 Flash vs 3.7 Flash karşılaştırması, eski modelin görev başına %31 daha az maliyetle hala daha iyi bir satın alma olduğu durumu ele alıyor.
Hangisini ne zaman seçmeli
Hacimli işler ve uygun maliyetli aracılar için Gemini 3.8 Flash'i seçin
Günde binlerce aracı görevi yürütüyorsanız, 3.8 Flash varsayılan seçimdir. Bağımsız endekste premium modellerle eşleşir, Google'ın finans ve hukuk aracı sıralamalarında liderdir ve Ocak ayındaki iki katına çıkıştan sonra bile token başına maliyeti çok düşüktür. Ayrıca doğal olarak video, ses ve PDF girişlerini kabul eder, Toplu İşleme'yi %50 indirimle sunar, ayda 5.000 ücretsiz Google Arama temel alma isteği içerir ve prototipleme için ücretsiz bir katmanı vardır. Dezavantajları: yalnızca metin çıktısı, Canlı API yok, 65.536 tokenlık bir çıktı tavanı ve orta veya yüksek seviyelerde bütçelemeniz gereken bir token tüketimi.
En zorlu uzun vadeli akıl yürütme için Claude Fable 5.1'i seçin
Fable 5.1, başlangıç modeli değil, yükseltilecek modeldir. Yanlış bir cevabın token'lardan daha pahalıya mal olduğu işler için uygundur: çok saatlik araştırma ajanları, uzun terminal oturumları, daha ucuz bir modelin değerlendirmelerinin yetersiz kaldığı akıl yürütme zincirleri. 128K'lık çıktısı ve 0,25 $'lık önbellek okumaları, her turda aynı geniş bağlamı yeniden kullanan, ön ek ağırlıklı aracı döngüleri için uygundur; bu durumlarda, önbellek satırı etkin çarpanı 13,3 kattan çok daha küçük hale getirir. Modelin kendi teknik özellik belgesi için Claude Fable 5.1 nedir bölümüne bakın.
OpenAI ekosistemi aracı çalıştırmaları için GPT-5.6 Sol'u seçin
Sol, xhigh seviyesinde 59 puan alır, HLE-Verified'da 3.8 Flash ile eşleşir ve 5 $ / 30 $ fiyatla 128K çıktı ile birlikte gelir. Aracınız, değerlendirmeleriniz ve araçlarınız zaten OpenAI'nin yığınında yer alıyorsa, Sol ikinci bir satıcı gerektirmeyen premium seviyedir. Üçü arasında en pahalı önbellek okumalarına sahiptir, bu nedenle uzun önbellekli oturumlardan ziyade taze bağlamlı çalıştırmalar için daha uygundur. Grok 4.6 vs GPT-5.6 vs Claude Fable 5 karşılaştırması, Sol'un önceki Anthropic amiral gemisine karşı nasıl durduğunu gösteriyor.
Üçünü de tek bir Apidog çalışma alanında test edin
Yukarıdaki her argüman aynı şekilde sona eriyor: bunu kendi istemleriniz üzerinde ölçün. Apidog bir API istemcisi ve test platformudur, bu nedenle bu modellerden hiçbirini çalıştırmaz, ancak aynı isteği üç sağlayıcıya da göndermek ve geri dönenleri karşılaştırmak için hızlı bir yoldur.
Kurulum, üç ortama sahip tek bir projedir. Her ortam bir temel URL ve bir anahtar değişkeni barındırır: GEMINI_API_KEY ile https://generativelanguage.googleapis.com, Claude anahtarınızla Anthropic'in temel adresi ve OpenAI anahtarınızla OpenAI'nin temel adresi. Anahtarlar ortam değişkenlerinde kalır, asla istek gövdesinde veya paylaşılan koleksiyonda bulunmaz.
Ardından, aynı istemi taşıyan üç istek adımına sahip bir test senaryosu oluşturun. Gemini adımı, "model": "gemini-3.8-flash" ve "thinking_level": "medium" ile /v1beta/interactions adresine gönderim yapar; diğer ikisi ise sağlayıcılarının sohbet veya mesaj uç noktalarına gönderim yapar. Her adımda, karşılaştırma için önemli olan onaylamaları ekleyin: HTTP 200, yanıtın mevcut olduğunu doğrulayan bir JSON yolu ve token kullanım alanında bir tavan, böylece aniden iki kat fazla düşünme token'ı harcayan bir çalıştırma yüksek sesle başarısız olur. Gemini'de bu alan, eski uç nokta için usageMetadata.thoughtsTokenCount'tur; diğer ikisi için eşdeğer kullanım bloğunu onaylayın.
Senaryoyu bir dizi "altın istem"e karşı çalıştırın, ardından günlük çalışacak şekilde zamanlayın. Bir satıcı varsayılanları değiştirdiğinde veya bir model daha fazla token harcamaya başladığında, başarısız onaylama size faturadan önce bilgi verir. Yapay zeka ajanı API test kılavuzu bu desenin çok turlu versiyonunu, Apidog'da API testlerini zamanlama ise tekrarlayan çalıştırmayı kapsar. Üç ortamı kurmak için Apidog'u indirin.
Sıkça Sorulan Sorular
Gemini 3.8 Flash, Claude Fable 5.1'den daha mı iyi?
Artificial Analysis'in endeksinde, 3.8 Flash yüksek seviyede 59, Fable 5.1 ise orta seviyede 57 puan alıyor, bu nedenle test edilen ayarlarda birbirlerine yakınlar. Google'ın tabloları Fable 5.1'i içermiyor ve Anthropic'in kıyaslamaları 3.8 Flash'ı içermiyor, bu nedenle daha geniş bir karşılaştırma mevcut değil. Token başına, Flash tanıtım fiyatlarında 13,3 kat daha ucuz.
Üçünden hangisi aracı iş yükleri için en ucuzdur?
Gemini 3.8 Flash, token başına geniş bir farkla en ucuzudur; 31 Aralık 2026'ya kadar 0,75 $ / 3,75 $. Görev başına, Artificial Analysis yüksek seviyede 0,58 $, orta seviyede 0,41 $ ve düşük seviyede 0,24 $ ölçmüştür, çünkü model 3.7 Flash'tan yaklaşık %30 daha fazla çıktı token'ı harcar. Taahhütte bulunmadan önce token başına değil, tamamlanmış görev başına maliyeti ölçün.
Üçünün de 1M bağlam penceresi var mı?
Evet. Gemini 3.8 Flash 1.048.576 giriş token'ını kabul ederken, Fable 5.1 ve GPT-5.6 Sol'un ikisi de 1M listeler. Maksimum çıktı farklıdır: 3.8 Flash'ta 65.536 token, diğer ikisinde ise 128K.
Claude Fable 5.1 neden Google'ın kıyaslama tablolarında yer almıyor?
Google'ın yayınladığı satırlarda Anthropic girişleri olarak Claude Opus 5 ve Claude Sonnet 5 listeleniyor. Fable 5.1, 3.8 Flash'tan bir gün önce, 1 Eylül'de piyasaya sürüldüğü için dahil edilmedi. Fable 5.1'in Anthropic tarafından yürütülen kendi rakamları için, Claude Fable 5.1 vs Opus 5 karşılaştırmasına bakın.
Gemini fiyat avantajı 2027'de de devam edecek mi?
Kısmen. 1 Ocak 2027'den itibaren Gemini 3.8 Flash, 1,50 $ / 7,50 $'a yükselecek, bu da Fable 5.1'i her iki hatta 6,7 kat, Sol'u ise girişte 3,3 kat ve çıkışta 4 kat daha pahalı hale getirecek. Hala daha ucuz, ancak farkın yarısı kadar.
Önce hangisini çağırmalı
Hacimli olarak çalıştırdığınız her şey için Gemini 3.8 Flash ile başlayın, her rota için thinking_level'ı ayarlayın ve etiket fiyatına değil, görev başına token'lara dikkat edin. Daha ucuz modellerdeki değerlendirmeleriniz yetersiz kaldığında ve bağlam turlar arasında önbelleğe alındığında Claude Fable 5.1'e geçin. Yığınlarınızın geri kalanı OpenAI olduğunda ve ikinci bir satıcı olmadan premium bir katman istediğinizde GPT-5.6 Sol'u kullanın. Hangisini seçerseniz seçin, önce aynı istemi tek bir test senaryosunda üçüne de uygulayın; fiyat oranı halka açık olsa da, kendi istemlerinizdeki görev başına maliyet oranını ölçmek size kalmıştır.
