Google, 13 Ağustos 2026'da, 3.6 Flash'tan üç hafta sonra Gemini 3.7 Flash'ı piyasaya sürdü ve onu "en akıllı işgücü modelimiz" olarak adlandırdı. Benchmark farkları bu güveni destekliyor. DeepSWE %49.0'dan %65.3'e, AutomationBench %17.0'dan %30.4'e sıçradı ve 1 milyon giriş token'ı başına 0.75 dolarlık tanıtım fiyatı, 3.6 Flash'ın lansman fiyatının yarısı seviyesinde.
Bu kombinasyon, her API ekibinin bu çeyrekte karşılaştığı bir soruyu zorunlu kılıyor: hızlı, ucuz bir Gemini modeli artık Claude veya GPT'ye yönlendirdiğiniz iş yüklerini kapsıyor mu? Bu karşılaştırma, doğrulayabileceğiniz şeylere odaklanıyor: bağlam pencereleri, modaliteler, araç desteği, fiyatlandırma yapısı ve entegre edeceğiniz istek şemaları; rakip sayıları karşılaştırılabilir olmadığında belirtiliyor. Ve "hangi API'yi kullanmalısınız" sorusunun dürüst cevabı "iş yükünüzde kazanan" olduğu için, son bölüm, taahhütte bulunmadan önce üçünü Apidog'da yan yana nasıl çalıştıracağınızı gösteriyor.
Eğer Gemini'yi seçerseniz ve kurulum adımlarını öğrenmek isterseniz, Gemini 3.7 Flash API hızlı başlangıç kılavuzu anahtarları, uç noktaları ve ilk istekleri kapsar.
TL;DR
- Gemini 3.7 Flash: 1 milyon token bağlamı, 64 bin çıktı sınırı, metin, görüntü, video, ses ve PDF genelinde yerel giriş, ayrıca fonksiyon çağırma, araç olarak arama ve bilgisayar kullanımı.
- Tanıtım fiyatlandırması: 31 Aralık 2026'ya kadar 1 milyon giriş token'ı başına 0.75 dolar ve 1 milyon çıktı token'ı başına 3.75 dolar, 1 Ocak 2027'de 1.50 dolara ve 7.50 dolara iki katına çıkacak.
- 3.6 Flash'a göre kodlama kazanımları: DeepSWE v1.1 %49.0'dan %65.3'e, FrontierCode 1.1 Main %34.4'ten %43.6'ya, AutomationBench %17.0'dan %30.4'e.
- Claude Fable 5 ve GPT-5.6 Sol, token başına fiyatın birkaç katı olmasına rağmen, ileri düzey kodlama derinliği ve ajan tutarlılığı konusunda hala lider.
- Üç sağlayıcı uyumsuz istek şemaları kullanır: Google
contents, Anthropic Messages, OpenAImessages. - Benchmarklar ortalamaları tahmin eder, iş yükünüzü değil; karar vermeden önce üç API'de de 20 istemli bir karşılaştırma yapın.
Bu karşılaştırma nasıl okunur?
Bu, amiral gemisi modellere karşı amiral gemisi modellerin bir eşleşmesi değildir. Claude Fable 5 ve GPT-5.6 Sol, maksimum yetenek için fiyatlandırılmış amiral gemileridir; Gemini 3.7 Flash ise hacim için fiyatlandırılmış bir işgücüdür. Google, amiral gemisi beklerken bunu piyasaya sürüyor: Axios raporuna göre Gemini 3.5 Pro'nun hala gecikmeli olduğu ve Flash güncellemelerinin ondan önce geldiği belirtildi.
Karşılaştırma yapmaya değer: 3.7 Flash'ın lansman skorları artık haftalar önce ileri düzey modellerin bulunduğu aralıkla örtüşüyor ve bu, amiral gemileri önde kalsa bile yönlendirme hesabını değiştiriyor.
İki uyarı geçerlidir. Birincisi, buradaki her sayı bir lansman haftası, satıcı tarafından bildirilen rakamdır; bağımsız değerlendirmeler gelene kadar bunları yönlendirici olarak ele alın. İkincisi, benchmark varyantları önemlidir. Google, FrontierCode 1.1 Main'i rapor ederken, Claude ve GPT için lansmanlarında yayınlanan sayılar Extended split'ten geliyordu, bu yüzden bu sütunlar burada asla bir tabloyu paylaşmaz.
Özellikler yan yana
Teknik özellikler sayfası, Gemini 3.7 Flash'ın çok daha pahalı modellere karşı kendi başına ayakta durduğu yerdir. Tam teknik detaylar Gemini Flash model sayfasında yer almaktadır.
| Gemini 3.7 Flash | Claude Fable 5 | GPT-5.6 Sol | |
|---|---|---|---|
| Geliştirici | Anthropic | OpenAI | |
| Bağlam penceresi | 1 milyon token | 1 milyon token | 1.05 milyon token |
| Çıktı sınırı | 64 bin token | Sağlayıcı belgelerine bakın | Sağlayıcı belgelerine bakın |
| Giriş modaliteleri | Metin, görüntü, video, ses, PDF | Metin, görüntü | Metin, görüntü |
| Çıktı | Metin | Metin | Metin |
| Araç desteği | Fonksiyon çağırma, araç olarak arama, bilgisayar kullanımı | Fonksiyon çağırma, araç kullanımı | Fonksiyon çağırma, yerleşik araçlar |
| İstek şeması | Google contents + generationConfig |
Anthropic Messages | OpenAI messages |
| Kimlik Doğrulama | x-goog-api-key başlığı |
x-api-key + sürüm başlığı |
Bearer token |
| Fiyatlandırma (1 milyon token başına) | Giriş: $0.75/$3.75; Ocak 2027'den itibaren: $1.50/$7.50 | Premium ileri düzey katman | Premium ileri düzey katman |
| Konumlandırma | Yüksek hacimli işgücü | Uzun vadeli ajan çalışması | Depo ölçeğinde kodlama derinliği |
Bağlam pencereleri artık etkili bir şekilde eşit, bu yüzden o satır artık hiçbir şeyi belirlemiyor. Modalite ve fiyatlandırma satırları, üçünün birbirinden ayrıldığı yerlerdir ve sonraki bölümlerde her ikisi de ayrıntılı olarak ele alınır.
Kodlama ve ajan görevleri
Google'ın 3.7 Flash için öne çıkan iddiaları geliştirici odaklıdır: hata ayıklamada daha iyi, ilk denemede dağıtılabilir kod üretme yeteneği daha yüksek ve çok adımlı planlama ve araç çağrılarında daha gayretli. 9to5Google'ın lansman haberlerinde doğrulanan nesilden nesile sayılar, bu iddiaları desteklemektedir.
| Benchmark | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|
| DeepSWE v1.1 (depo ölçeğinde düzeltmeler) | %49.0 | %65.3 |
| FrontierCode 1.1 Main | %34.4 | %43.6 |
| WebDev Arena (Elo) | 1538 | 1588 |
| GDP.pdf (belge akıl yürütme) | %22.0 | %34.0 |
| AutomationBench (ajan görevleri) | %17.0 | %30.4 |
AutomationBench'teki sıçrama, ajan geliştiricilerin dikkatle incelemesi gereken bir noktadır. Üç hafta içinde ajanssal bir benchmark'ı neredeyse ikiye katlamak, "araç çağrıları üzerinde daha gayretli düşünür" iddiasının pazarlamadan ibaret olmadığını gösteriyor.
Peki bu, Claude ve GPT'ye karşı nasıl bir tablo oluşturuyor? DeepSWE v1.1'de, ileri düzey katman lansmanında GPT-5.6 Sol Max için %73.0, Grok 4.6 için %65.9 kaydetti; Grok 4.6 vs GPT-5.6 Sol vs Claude Fable 5 karşılaştırmamız bu sonuçları derinlemesine ele almaktadır. Sol Max, depo ölçeğindeki hata düzeltmelerinde gerçek bir liderliği sürdürüyor ve Claude Fable 5'in gücü, kodlama ve ajan değerlendirmelerinde nadiren ikinci sıradan kötü olmasıyla tutarlılık gösteriyor. Gemini 3.7 Flash bu farkı kapatmadı. Maliyetin çok daha düşük bir kısmıyla çarpıcı bir mesafeye ulaştı, bu da "en iyi skor kazanır"dan farklı bir değer önerisidir.
İki uzman sayısı tabloyu tamamlıyor: hukuksal akıl yürütmede Harvey LAB-AA'da %90.7 ve 1 milyon bağlam penceresini pratikte güvenilir kılan 128k iğne alımında %97.0 skor.
Çok modlu giriş
Bu, üç API arasındaki en net yapısal farklılıktır. Gemini 3.7 Flash, metin, görüntü, video, ses ve PDF'i aynı contents dizisinde tek bir uç noktaya karşı kabul eder. Claude ve GPT metin ve görüntüleri iyi işler, ancak video ve ses iş yükleri genellikle metin modele ulaşmadan önce ayrı transkripsiyon veya ön işleme adımlarından geçer.
Ürününüz belgelere dokunuyorsa, GDP.pdf'teki %22.0'dan %34.0'a sıçrama ilgili sinyaldir: bu benchmark, tablolar, taramalar ve bozuk düzenlere sahip gerçek dünya PDF'leri üzerindeki akıl yürütmeyi ölçer. Bir sözleşmeyi veya faturayı bir OCR boru hattı olmadan doğrudan modele beslemek, mimarinizden tüm hata eğilimli bir aşamayı kaldırır.
Pratik kural: metin ve görüntü sohbeti için modalite önemsizdir. Video kareleri, çağrı kayıtları veya belge yığınları için Gemini, giriş boru hattının tek bir API çağrısına dönüştüğü üçünden tek olandır.
Fiyatlandırma felsefesi
Üç satıcı farklı fiyatlandırma stratejileri uyguluyor ve bu fark, her modelin kimin için olduğunu gösteriyor.
Google, 3.7 Flash'ı pazar payı kapmak için fiyatlandırıyor. 31 Aralık 2026'ya kadar 1 milyon giriş token'ı başına 0.75 dolar ve 1 milyon çıktı token'ı başına 3.75 dolarlık tanıtım oranı geçerlidir ve bu, 3.6 Flash'ın lansmandaki maliyetinin yarısıdır. 1 Ocak 2027'de standart oran 1.50 ve 7.50 dolara, yani tam 2 katına çıkacaktır. Bu son tarih zorlayıcı bir işlevdir: Google, fiyat sıfırlanmadan önce trafiğinizin taahhüt edilmesini istiyor. Chatbot'lar ve ajan döngüleri için örneklerle birlikte tüm token matematiği, Gemini 3.7 Flash fiyatlandırma dökümümüzde yer almaktadır.
Anthropic ve OpenAI, amiral gemilerini premium yetenek olarak fiyatlandırıyor. Oranlar katmana göre değişir ve sık sık güncellenir, ancak yapı tutarlıdır: ileri düzey çıktı token'ları Flash'ın ücretlendirdiğinden birkaç kat daha pahalıdır ve her iki satıcı da premium'u daha az başarısız çalıştırma üzerinden satar, daha ucuz token'lar üzerinden değil. Anthropic, tek bir model içinde maliyet ile yeteneği dengeleyen bir efor parametresi ekler; OpenAI ise model boyutları arasında katmanlama yapar.
Hangi felsefenin kazanacağı, hata ekonominize bağlıdır. Bir görevi yerine getiremeyen ucuz bir model, kaydedilen token'lardan daha pahalıya mal olan onarım işleri yaratır; premium bir model ise ancak bu hataları önlediğinde ücretini hak eder. Token başına maliyeti değil, tamamlanmış görev başına maliyeti karşılaştırın ve Gemini'nin oranları iki katına çıktığında, 1 Ocak 2027'den sonra fiyatları yeniden değerlendirin.
API ergonomisi
Şema farklılıkları, sağlayıcıları değiştirdiğinizde veya aralarında yönlendirme yaptığınızda ödediğiniz bedeldir. İşte aynı tek dönüşlü isteğin üç farklı şekli.
Google'ın Gemini API'si, dönüşleri contents içinde parts ile sarar ve üretim ayarları generationConfig içinde yer alır:
{
"contents": [
{ "role": "user", "parts": [{ "text": "Summarize this changelog." }] }
],
"generationConfig": { "temperature": 0.3, "maxOutputTokens": 1024 }
}
Anthropic'in Mesajlar API'si, modeli ve zorunlu bir max_tokens değerini en üst düzeye yerleştirir ve sistem istemi kendi alanı olarak bulunur:
{
"model": "claude-fable-5",
"max_tokens": 1024,
"system": "You summarize changelogs in three bullets.",
"messages": [{ "role": "user", "content": "Summarize this changelog." }]
}
OpenAI, sistem istemini doğrudan messages dizisine katlar:
{
"model": "gpt-5.6-sol",
"messages": [
{ "role": "system", "content": "You summarize changelogs in three bullets." },
{ "role": "user", "content": "Summarize this changelog." }
]
}
Metin durumu, bir adaptörle geçiştirilebilecek kadar benzer görünüyor. Soyutlamanın sızdığı yer araç kullanımıdır: Google, fonksiyonları functionDeclarations ile bir tools dizisinde bildirir ve çağırmayı toolConfig aracılığıyla kontrol eder, Anthropic farklı yanıt bloklarıyla kendi araç şemasını kullanır ve OpenAI'ın yine kendi fonksiyon formatı vardır. Her üçü de sunucu tarafından gönderilen olayları kullansa da, akışlı parça şekilleri de farklılık gösterir. Ağ geçitleri ve uyumluluk uç noktaları temel sohbet şeklini normalleştirir, ancak çok modlu parçalar ve araç çağrıları nadiren temiz bir şekilde çeviriden sağ çıkar; aynı sorunu DeepSeek V4 Pro için API format karşılaştırmasında satıcılar arasında belgeledik.
Entegrasyon tavsiyesi gösterişsizdir: ürününüz ile model arasında ince bir sağlayıcı katmanı tutun. Bunu yapan ekipler, çeyrekler yerine günler içinde sağlayıcıları değiştirir.
Hangisini ne zaman seçmeli
Benchmarklar ve şemalar bir karar listesine yoğunlaştırıldı:
- Yüksek hacimli ajan trafiği, video, ses veya PDF'leri alan çok modlu boru hatları ve çağrı başına maliyetin ürünün marjını sınırladığı her türlü iş yükü için Gemini 3.7 Flash'ı seçin. Ayrıca bilgisayar kullanımı deneyleri için açık bir kum havuzudur; bilgisayar kullanımı ile yapılandırılmış API'ler arasındaki karşılaştırmamız, bu yeteneğin ne zaman kendini amorti ettiğini kapsar.
- Çok saatlik ajan oturumları, tek bir raydan çıkan adımın bir saatlik ilerlemeyi boşa harcadığı görevler ve efor parametresinin maliyet-yetenek kadranını ödüllendiren iş yükleri gibi uzun vadeli otonom çalışmalar için Claude Fable 5'i seçin.
- Büyük mevcut kod tabanlarında minimum denetimle çalışan depo ölçeğinde kodlama ajanları için ve API etrafında en derin üçüncü taraf ekosistemini isteyen ekipler için GPT-5.6 Sol'u seçin.
- Yapabiliyorsanız bir yönlendirici seçin. Çoğu üretim ekibinin üzerinde anlaştığı model şudur: ucuz bir varsayılan model trafiğin büyük kısmını ele alır ve en zor %10'luk kısım ileri düzey bir modele yönlendirilir. Gemini 3.7 Flash'ın lansman sayıları, 3.6 Flash için doğru olmayan bir şekilde, bu mimaride güvenilir bir varsayılan haline getiriyor.
Üç sağlayıcıyı tek bir Apidog çalışma alanında test edin
Önemli olan karşılaştırma, kendi istemleriniz üzerinde yaptığınızdır. Apidog, Google, Anthropic ve OpenAI için koleksiyonları tek bir projede tutar, böylece karşılaştırma bir sprint yerine bir öğleden sonra sürer:
- Her sağlayıcı için birer tane olmak üzere, kendi temel URL'si ve kimlik doğrulama başlığına sahip üç ortam oluşturun: Gemini için
x-goog-api-key, Anthropic içinx-api-key, OpenAI için bir Bearer token. Sağlayıcı değiştirmek bir kod değişikliği değil, bir açılır menü seçeneği haline gelir. - Ürününüzden 20 gerçek istem toplayın. Sistem isteminizi, fonksiyon çağırma kullanıyorsanız araç tanımlarınızı ve en az beş bilinen zorlu durumu ekleyin.
- Önem verdiğiniz şeyler için onaylar ekleyin: yanıt geçerliliği, her sağlayıcının kullanım bloğundan token sayıları, gecikme eşikleri. Araç çağırma iş yükleri için, araç çağırma JSON'unun ayrıştırıldığını ve şemanızla eşleştiğini doğrulayın; modeller burada düz yazıya göre çok daha sık başarısız olur.
- Her paketi her model için üç kez çalıştırın. LLM çıktısı değişir; üç çalıştırma, tek bir demonun gizlediği varyansı ortaya çıkarır. Başarı oranını ve başarılı görev başına maliyeti karşılaştırın.
- Paketi saklayın. Model sürümleri artık haftalar arayla geliyor; 3.7 Flash, 3.6'yı üç hafta sonra takip etti. Sürekli bir test takımına sahip ekipler, anekdotlarla değil, bir öğleden sonra yeniden karar verir.
Sıkça Sorulan Sorular
Gemini 3.7 Flash, kodlama için Claude veya GPT'den daha mı iyidir?
En üst seviyede değil. GPT-5.6 Sol Max, DeepSWE v1.1'de 3.7 Flash'ın %65.3'üne karşılık %73.0 elde etti ve Claude Fable 5, kodlama ve ajan benchmarklarında tutarlılık açısından lider. Değişen şey fiyat-puan oranı: 3.7 Flash, haftalar önce ileri düzey modellerin olduğu puanlara işgücü fiyatlarıyla ulaşıyor.
Gemini 3.7 Flash, Claude veya GPT'den ne kadar daha ucuz?
31 Aralık 2026'ya kadar Gemini 3.7 Flash, 1 milyon giriş token'ı başına 0.75 dolar ve 1 milyon çıktı token'ı başına 3.75 dolar maliyetle sunulmaktadır. İleri düzey Claude ve GPT modelleri token başına birkaç kat daha fazla ücret alır; maliyetleri modellemeden önce canlı fiyatlandırma sayfalarını kontrol edin. Tanıtım oranının 1 Ocak 2027'de iki katına çıkacağını unutmayın.
Gemini 3.7 Flash'ı OpenAI SDK aracılığıyla çağırabilir miyim?
Google, temel sohbet şeklini işleyen OpenAI uyumlu bir uç nokta sunar, böylece metin girişi ve metin çıkışı için bir base_url değişimi işe yarar. Çok modlu parçalar ve araç çağrıları düzgün bir şekilde eşleşmez, bu yüzden düz sohbetin ötesindeki her şey için yerel contents şemasını kullanın. Gemini 3.7 Flash için fonksiyon çağırma eğitimi, yerel araç formatını uçtan uca gösterir.
Gemini 3.7 Flash, bilgisayar kullanımını ve arama temellendirmesini destekliyor mu?
Evet. Fonksiyon çağırma, araç olarak arama ve bilgisayar kullanımı ile birlikte güncellenmiş CBRN ve siber güvenlik koruma rayları ile birlikte gelir. AutomationBench'teki %17.0'dan %30.4'e olan iyileşme, ajanssal döngünün ne kadar daha iyi hale geldiğine dair yayınlanmış en yakın göstergedir.
Gemini 3.7 Flash nerede mevcut?
Bir AI Studio anahtarı ile Gemini API, Google AI Studio, Gemini uygulaması, AI Pro ve Ultra aboneleri için Gemini Spark, Google Antigravity, Android Studio ve Gemini Enterprise aracılığıyla 160'tan fazla ülkede. Üretim GCP ekipleri, bir API anahtarı yerine OAuth ile Vertex AI üzerinden çağırabilir.
3.7 Flash yığınınızda nereye sığar?
Bu karşılaştırmadan çıkarılacak yanlış sonuç "Gemini ileri düzey modelleri yakaladı" olur. Yakalamadı; Sol hala depo ölçeğinde kodlama derinliğine ve Fable 5 hala uzun vadeli güvenilirliğe sahip. Doğru çıkarım ise tabanın değiştiği: işgücü fiyatları artık bir çeyrek önce premium oranları haklı çıkaran puanları satın alıyor, bu da herhangi bir yönlendirici mimarisinde varsayılanı sıfırlıyor. Flash sınıfı modeller toplu işleri, amiral gemileri ise tırmanışları yönetir.
Karar ölçülebilir, bu yüzden ölçün. Üç sağlayıcıyı tek bir çalışma alanına bağlayın, gerçek istemlerinizi onaylarla çalıştırın ve tamamlanmış görev başına maliyetin kazananı seçmesine izin verin. Apidog'u ücretsiz indirin, üç ortamı kurun ve tanıtım fiyatlandırma penceresi kapanmadan önce sağlayıcı düzeyinde kanıta sahip olun.

