Gemini 3.8 Flash, Google'ın en yeni Flash seviyesi modelidir ve 2 Eylül 2026'da, Gemini 3.8 Flash Cyber adlı güvenlikli ikiziyle birlikte piyasaya sürülmüştür. Bu, altı hafta içindeki üçüncü Flash sürümüdür; 21 Temmuz'daki Gemini 3.6 Flash ve 13 Ağustos'taki 3.7 Flash'ın ardından geliyor ve 3.7 Flash ile aynı tanıtım fiyatına sahip: 31 Aralık 2026'ya kadar milyon giriş jetonu başına 0,75 ABD doları ve milyon çıkış jetonu başına 3,75 ABD doları. Google, onu “uzun vadeli yazılım mühendisliği, otonom ajanlar ve karmaşık kurumsal iş akışları için tasarlanmış, en zeki Flash modelimiz” olarak adlandırıyor.
Başlıca değişiklik yeni bir fiyat veya daha büyük bir bağlam penceresi değil. Davranıştır. Google, 3.8 Flash'ı zorlu görevlerde “daha sıkı çalışacak” şekilde tasarladı: daha küçük muhakeme adımları atıyor, işini yol boyunca doğruluyor ve araçları yinelemeli olarak çağırıyor. Bu, ajanik kıyaslamalarda ölçülebilir kazanımlar sağlıyor ve modelin tasarım gereği görev başına daha fazla jeton harcaması anlamına geliyor. Artificial Analysis, 3.7 Flash'tan yaklaşık %30 daha fazla çıkış jetonu ölçtü. Eğer jetona göre bütçe yapıyorsanız, fiyat sabit. Eğer göreve göre bütçe yapıyorsanız, fatura arttı.
Bu kılavuz, tüm lansmanı kapsıyor: özellikler, “daha sıkı çalışma” dengesi, kıyaslamalar, fiyatlandırma, kullanılabilirlik, Cyber ikizi ve modelin yapamadıkları. Buradaki her istek, JSON ile basit HTTP'dir, bu nedenle uygulama koduna ulaşmadan önce bunları Apidog'da oluşturabilir ve inceleyebilirsiniz. Google'ın lansman yazısı ve model sayfası birincil kaynaklardır.
Bir Bakışta Gemini 3.8 Flash
| Özellik | Değer |
|---|---|
| API model Kimliği | gemini-3.8-flash (kararlı, önizleme eki yok) |
| Yayın tarihi | 2 Eylül 2026 |
| Temel aldığı model | Gemini 3.7 Flash (DeepMind model kartına göre) |
| Bağlam penceresi | 1.048.576 giriş jetonu |
| Maksimum çıkış | 65.536 jeton |
| Giriş modaliteleri | Metin, görsel, video, ses, PDF |
| Çıkış modaliteleri | Yalnızca metin |
| Düşünme seviyeleri | düşük, orta (varsayılan), yüksek; minimal hata döndürür |
| Giriş fiyatı (31 Aralık 2026'ya kadar) | Milyon jeton başına 0,75 ABD doları giriş / 3,75 ABD doları çıkış; düşünme çıkış olarak faturalandırılır |
| Standart fiyat (1 Ocak 2027'den itibaren) | Milyon jeton başına 1,50 ABD doları giriş / 7,50 ABD doları çıkış |
| Bağlam önbelleğe alma | Önbelleğe alınan milyon jeton başına 0,075 ABD doları (giriş), 0,15 ABD doları standart |
| Toplu API | %50 indirim: 0,375 ABD doları / 1,875 ABD doları giriş |
| Bilgi kesim tarihi | Mart 2026 |
| Geliştirici kullanılabilirliği | Gemini API, Google AI Studio, Android Studio, Google Antigravity, Stitch, Gemini Enterprise |
| Tüketici kullanılabilirliği | Gemini uygulaması (AI Pro ve Ultra aboneleri), Arama'da AI Modu, Google E-Tablolar'da Gemini |
| 3.7 Flash durumu | Tamamen desteklenmeye devam ediyor; kullanım sonlandırma tarihi yok |
Üç satırın tekrar incelenmesi gerekiyor. Varsayılan düşünme seviyesi, Gemini 3 Pro'daki gibi yüksek değil, orta'dır, bu nedenle Pro'da ayarlanmış bir istem, seviyeyi ayarlamadığınız sürece burada daha az muhakeme yapar. minimal seviyesi, sessizce düşük seviyeye eşlemek yerine bir doğrulama hatası döndürür; düşünme seviyeleri kılavuzu bu düzeltmeyi kapsar. Ve Mart 2026 kesim tarihi, model kartında bir uyarı içerir: bazı alanlarda, bilgi Ocak 2025 ile sınırlı olabilir.
Gemini 3.8 Flash Nedir
Flash, Google'ın iş yükü kademesidir: Pro en zor sorunları ele alırken çoğu üretim trafiğini çalıştırmak için tasarlanmış modeldir. Google, 3.8 Flash'ı “şimdiye kadarki en zeki iş yükü modelimiz” olarak adlandırıyor ve DeepMind model kartı onu yeni bir temel model yerine 3.7 Flash tabanlı olarak tanımlıyor. Dolayısıyla, dürüst bir ifadeyle, üç hafta önce piyasaya sürülen bir modelin, uzun soluklu yazılım mühendisliği ve ajan çalışmaları için optimize edilmiş bir iyileştirmesidir.

Yayın ritmi alışılmadık. 3.6 Flash 21 Temmuz'da 1,50 ABD doları / 7,50 ABD doları fiyatıyla, 3.7 Flash 13 Ağustos'ta 0,75 ABD doları / 3,75 ABD doları tanıtım fiyatıyla ve 3.8 Flash 2 Eylül'de aynı fiyatla piyasaya sürüldü. Google'ın ifadesi "altı hafta içinde üçüncü Flash sürümü"; Artificial Analysis, 3.5 Flash-Lite'ı da saydığı için dört aydan kısa sürede dördüncü bir Flash modeli sayıyor. Model yapılandırmasını sürdüren herkes için, 3.7 Flash'taki yenilikler yazısı üç haftalıktır ve zaten önceki nesli tanımlar. Bu sürümle birlikte Gemini 3.8 Pro, Gemini 4 veya yeni Flash-Lite gönderilmedi ve Google, Pro güncellemesinin ne zaman geleceğini belirtmedi.
“Daha Sıkı Çalışma” Tasarımı ve Maliyeti
Google'ın değişiklik açıklaması spesifiktir. Karmaşık görevlerde, 3.8 Flash “ekstra muhakeme adımları yürütür ve araçları yinelemeli olarak çağırır.” “Daha küçük muhakeme adımları” atar ve “işini yol boyunca doğrular.” Google, sonucunu doğrudan belirtir: model, özellikle daha yüksek çaba seviyelerinde, “tasarım gereği, daha uzun süreli ve karmaşık görevlerde daha fazla jeton kullanabilir.”
Artificial Analysis bunu bağımsız yazılarında ölçtü. Zeka Endeksi'ni çalıştırarak, yüksek muhakeme seviyesindeki 3.8 Flash, görev başına ortalama 48.000 çıkış jetonu kullandı, bu da 3.7 Flash'tan %30 daha fazla. Jeton başına fiyatlar değişmedi, bu nedenle görev başına maliyet 3.7 Flash yüksek seviyesinde 0,40 ABD dolarından 3.8 Flash yüksek seviyesinde 0,58 ABD dolarına yükseldi. Görev başına süre de arttı: 2,2 dakikadan 2,5 dakikaya çıktı.
Aynı rapor, elinizdeki kaldıraçı gösteriyor. orta seviyesinde, görev başına maliyet 0,41 ABD dolarına düşer, bu da 3.7 Flash'ın yüksek seviyesine yakındır. düşük seviyesinde ise, görev başına 0,8 dakika ile 0,24 ABD dolarına düşer. Dolayısıyla düşünme seviyesi artık küresel bir ayar değil, bir yönlendirme kararıdır: gecikmeye duyarlı uç noktalar için düşük, işi bitirmesi gereken ajan döngüleri için orta veya yüksek. Fiyatlandırma dökümü, her seviyede günde 1.000 ajan görevi üzerinden çalışır.
Hız değişmedi. Google'dan Logan Kilpatrick, 3.8 Flash'ı “3.7 ile aynı fiyatta, ~aynı hızda” olarak tanımladı ve Artificial Analysis, yüksek muhakemede saniyede 302.1 çıkış jetonu ölçtü. Bu çalıştırmadaki ilk jetona ulaşma süresi olan 13.30 saniye, yavaş bir ağ yolu değil, modelin yanıt vermeden önce düşünmesidir.
Kıyaslamalar Ne Diyor
Google, DeepMind Flash sayfasında metin biçiminde üç kıyaslama tablosu yayınladı. Bunlar Google tarafından yürütülen rakamlardır.
| Kıyaslama | 3.8 Flash | 3.7 Flash | Claude Opus 5 | GPT-5.6 Sol | GPT-5.6 Terra | Claude Sonnet 5 |
|---|---|---|---|---|---|---|
| Vals Finans Ajanı v2 | %61,4 | %59,0 | %58,6 | %53,8 | %54,4 | %53,9 |
| Harvey Hukuk Ajanı Kıyaslaması | %10,0 | %8,8 | %6,7 | %2,5 | %0,8 | %5,0 |
| HLE-Doğrulanmış | %54,9 | %53,6 | %54,4 | %54,5 | %51,1 | %31,0 |
3.7 Flash üzerindeki kazanımlar 2,4, 1,2 ve 1,3 puandır. Mütevazı ama finans ve hukuk satırları, jeton başına birkaç kat daha fazla maliyetli olan Opus 5 ve GPT-5.6 Sol'un önüne Flash fiyatlı bir model koyuyor. Bir gün önce piyasaya sürülen Claude Fable 5.1, Google'ın tablolarında yer almıyor; üçlü karşılaştırma, en yakın yayınlanan girişler olarak Anthropic'in Opus 5 ve Sonnet 5 satırlarını kullanıyor.
Google, metin biçiminde sayılar olmaksızın üç iddia daha öne sürüyor. DeepSWE v1.1'de, 3.8 Flash “çoğu daha büyük öncü modeli” “maliyetinin bir kısmına” geride bırakıyor; yüzde, yalnızca model kartının görsel tablolarında yer aldığından, biz basmıyoruz (3.7 Flash %65,3 puan aldı). Belge ağırlıklı, uzun süreli iş akışlarında, dahili bir değerlendirme, Gemini 3.7 Flash'tan “üç kattan fazla görev tamamladığını” gösteriyor. Gray Swan istem enjeksiyonunda Google, rakam belirtmeksizin “önemli bir sıçrama” bildirdi. SWE-Bench Pro, Terminal-bench ve OSWorld sonuçları 3.8 Flash için metin olarak yayınlanmamıştır.
Bağımsız görüşler aynı doğrultuda. Artificial Analysis, Zeka Endeksi'nde 3.8 Flash'ı (yüksek) 59 puanla derecelendirdi; bu, 3.7 Flash için 56 ve 3.6 Flash için 52 puandan daha yüksek. Bu, GPT-5.6 Sol (xhigh) ve Grok 4.6 (orta) ile aynı seviyede olup, GPT-5.6 Terra (maks), Claude Fable 5.1 (orta) ve Muse Spark 1.2 (xhigh) modellerinin (hepsi 57 puan) üzerindedir. τ³-Banking araç kullanımı değerlendirmelerinde, 3.8 Flash %45 puan alarak 3.7 Flash'ın 12 puan üzerinde yer aldı. 3.8 ve 3.7 Flash karşılaştırması, bu kazanımları iş yüküne göre jeton maliyetiyle dengeler.
Fiyatlandırma: Jeton Başına Aynı, Görev Başına Daha Fazla
Fiyatlandırma sayfası, 3.8 Flash'ı 3.6 ve 3.7 Flash ile aynı satırlarda listeliyor ve üçünün de fiyatı 1 Ocak 2027'de iki katına çıkacak.
| Öğe | 31 Aralık 2026'ya kadar | 1 Ocak 2027'den itibaren |
|---|---|---|
| Giriş | 0,75 ABD doları / 1 M | 1,50 ABD doları / 1 M |
| Çıkış (düşünme dahil) | 3,75 ABD doları / 1 M | 7,50 ABD doları / 1 M |
| Önbelleğe alınmış giriş | 0,075 ABD doları / 1 M | 0,15 ABD doları / 1 M |
| Önbellek depolama | 0,50 ABD doları / 1 M jeton / saat | 1,00 ABD doları / 1 M jeton / saat |
| Toplu giriş / çıkış | 0,375 ABD doları / 1,875 ABD doları | 0,75 ABD doları / 3,75 ABD doları |
İki detay insanları şaşırtıyor. Düşünme jetonları çıkış jetonlarıdır: çıkış ücreti üzerinden faturalandırılır ve usageMetadata.thoughtsTokenCount içinde ayrı ayrı raporlanır, bu nedenle yüksek seviyede kısa bir yanıt, düşük seviyede uzun bir yanıttan daha pahalıya mal olabilir. Ve Google Arama tabanının kendi ölçerleri vardır: tüm Gemini 3.x modelleri arasında paylaşılan ayda 5.000 ücretsiz istek, ardından her 1.000 istek için 14 ABD doları.
AI Studio ve API'de hız sınırlamalı ücretsiz bir katman bulunmaktadır; Google, ücretsiz katman verilerinin “ürünlerimizi geliştirmek için kullanıldığını” belirtiyor. Model başına hız sınırları belgelerde değil, AI Studio'da gösterilir. 1. Kademe, bir faturalandırma hesabı bağlanarak açılır, 2. Kademe 100 ABD doları harcama ve üç gün sonra, 3. Kademe ise 1.000 ABD doları ve 30 gün sonra açılır. Ücretsiz erişim kılavuzu, ücretsiz yolun size ne sağladığını ve ne sağlamadığını kapsar; Toplu API kılavuzu ise bekleyebilecek işler için %50 indirimi kapsar.
Nasıl Çağrılır
Google artık Etkileşimler API'sini Gemini 3.x için birincil yol olarak görüyor. generateContent “eski olarak kabul ediliyor” ancak son kullanım tarihi olmaksızın “tamamen desteklenmeye devam ediyor” ve çoğu mevcut kod hala bunu kullanıyor. Minimal bir Etkileşimler isteği:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"HTTP önbelleğe almayı 3 cümlede açıklayın.","generation_config":{"thinking_level":"medium"}}'
Çok turlu konuşmalar previous_interaction_id'yi iletir ve sunucunun durumu korumasını sağlar. Fonksiyon çağırma, araçları bir JSON şemasıyla bildirir, bir function_call adımı alır ve hem call_id hem de name içeren bir function_result bekler, bunlar 3.8 Flash'ta zorunludur (eski generateContent alanı id olarak adlandırır). API kılavuzu her iki uç noktayı REST ve Python'da gösterir ve fonksiyon çağırma kılavuzu, “daha sıkı çalışma” tasarımının ürettiği yinelemeli araç döngülerini ve bunları nasıl sınırlayacağınızı kapsar.
3.7 Flash'tan geçiyorsanız, değişiklikler küçüktür ancak hataya yol açar: minimal düşünme reddedilir, thinking_budget yerine thinking_level kullanılır, candidate_count desteklenmez ve Google, temperature'ı varsayılan 1.0'da bırakmanızı önerir çünkü düşürülmesi “döngüye veya performans düşüşüne neden olabilir.” Geçiş kılavuzu, Google'ın yenilikler notlarını, öncesi ve sonrası JSON ile bir kontrol listesine dönüştürür.
Gemini 3.8 Flash Neler Yapamaz
Model sayfası açıkça belirtiyor. Desteklenmeyenler: ses üretimi, Canlı API ve görsel üretimi. Giriş metin, görsel, video, ses ve PDF kabul etse de, çıkış yalnızca metindir. Gemini 3 modellerinde görsel segmentasyonu da desteklenmiyor. Ürününüz gerçek zamanlı ses veya görsel çıkışa ihtiyaç duyuyorsa, bu model tüm yığın değil, muhakeme ve araç çağırma katmanıdır. Yoğun muhakeme gerektirmeyen ucuz, yüksek verimli metin için, Gemini 3.5 Flash-Lite, fiyat listesinde 0,30 ABD doları / 2,50 ABD doları olarak kalmaya devam ediyor. İşlev çağırma, yapılandırılmış çıktılar, bağlam önbelleğe alma, kod yürütme, Arama ve Haritalar tabanlama, Toplu API ve önizlemedeki Bilgisayar kullanımı dahil olmak üzere kontrol listesinin geri kalanı desteklenmektedir.
Gemini 3.8 Flash Cyber: Güvenlikli İkizi
Gemini 3.8 Flash Cyber aynı gün piyasaya sürüldü ve buna kaydolamazsınız. Erişim yalnızca, “güvenilir hükümet yetkilileri, kritik altyapı operatörleri ve yazılım bakımcıları”na açık olan yeni Fairwind Programı aracılığıyla sağlanır ve arka plan kontrolleri ile kimlik avına dayanıklı MFA gibi gereksinimleri içerir. Halka açık API, halka açık fiyatlandırma veya kendi kendine barındırma yoktur. 3.5 Flash Cyber sınırlı pilot programının yerini almıştır.
Google'ın iddiaları büyük: 20 programlama dilinde %70'in üzerinde gerçek dünya güvenlik açığı keşfetme başarı oranı ve bir Chrome güvenlik ekibi raporu, "çok daha büyük olan en iyi ticari modellerden 2,6 kat daha fazla doğru Chrome güvenlik açığı yaması." Her ikisi de Google tarafından rapor edilmiştir. Cyber açıklayıcısı, uygunluk, yükümlülükler ve erişim sağlayamayacak birçok ekip için ne anlama geldiğini kapsar.
Gemini 3.8 Flash İsteklerini Apidog'da Test Etme
Maliyet hikayesi jeton başına değil, görev başına olduğundan, faydalı test “çağrı başarılı oldu mu” değil, “kaç jeton yaktı”dır. Apidog bunu sıradan bir API testi olarak ele alır. GEMINI_API_KEY'i bir ortam değişkeni olarak saklayın, Etkileşimler ve generateContent isteklerini uç noktalar olarak kaydedin ve durum 200'ü, uygulamanızın okuduğu JSON alanlarını ve usageMetadata.thoughtsTokenCount üzerinde bir üst sınırı doğrulayın. Aynı istemi düşük, orta ve yüksek seviyelerinde tek bir test senaryosunda çalıştırın, böylece Artificial Analysis'in ortalamaları yerine kendi istemleriniz için seviye başına jeton dağılımını elde edersiniz.
Akış yanıtları SSE olarak oluşturulur, bu da includeThoughts: true ile düşünce özetlerini hata ayıklarken yardımcı olur; SSE test kılavuzu bunu adım adım açıklar. Senaryoyu günlük olarak planlayın ve bir jeton regresyonu, faturaya yansımadan önce bir doğrulamayı başarısız kılar. Ücretsiz planda kurmak için Apidog'u indirin.
Sıkça Sorulan Sorular
Gemini 3.8 Flash yeni bir model mi yoksa 3.7 Flash'a bir güncelleme mi? DeepMind model kartı, Gemini 3.7 Flash'a dayandığını söylüyor. Onu ayarlanmış bir halef olarak kabul edin: aynı fiyat, hız ve bağlam penceresiyle, zorlu görevlerde daha fazla muhakeme ve araç çağırma adımı içeriyor. 3.7 Flash, kullanım sonlandırma tarihi olmaksızın tamamen desteklenmeye devam ediyor.
Gemini 3.8 Flash neden 3.7 Flash'tan daha fazla jeton kullanıyor? Tasarım gereği. Google, “uzun süreli ve karmaşık görevlerde daha fazla jeton kullanabileceğini” söylüyor ve Artificial Analysis, endekslerinde %30 daha fazla çıkış jetonu ölçtü. Ekstra muhakeme gerektirmeyen rotalarda thinking_level'i orta veya düşük'e indirin; düşünme seviyeleri kılavuzu, seviye başına maliyet tablosunu içerir.
Gemini 3.8 Flash bağlam penceresi nedir? 1.048.576 giriş jetonu ve 65.536 çıkış jetonu, 31 Aralık 2026'ya kadar önbelleğe alınan milyon jeton başına 0,075 ABD doları bağlam önbelleğe alma maliyetiyle.
Gemini 3.8 Flash'ı ücretsiz Gemini uygulamasında kullanabilir miyim? Lansman kapsamı, Gemini uygulamasını Google AI Pro ve Ultra aboneleri için listeliyor, ücretsiz uygulama katmanı için değil. Geliştiriciler, AI Studio ve API'de hız sınırlamalı ücretsiz bir katman elde ederler.
Gemini 3.8 Flash, Claude Fable 5.1 ile nasıl karşılaştırılır? Artificial Analysis, onları 59 ve 57 olarak derecelendiriyor. Fiyat açısından, Claude Fable 5.1, milyon jeton başına 10 ABD doları / 50 ABD doları maliyetiyle, 3.8 Flash'ın hem giriş hem de çıkış için tanıtım fiyatının yaklaşık 13 katıdır. Görev başına jetonları saydığınızda fark daralır.
Sırada Ne Var
Gemini 3.8 Flash, daha uzun düşünen bir iş atıdır ve takas açıktır: ajanik kıyaslamalarda birkaç puan daha fazla ve araç kullanımında 12 puan, yüksek muhakemede yaklaşık %30 daha fazla çıkış jetonu ile ödenir. Ajanlarınız 3.7 Flash'ta duvara çarpıyorsa, yükseltmenin jeton başına maliyeti aynıdır. Trafiğiniz gecikmeye bağlı bir sohbet ise, düşük seviyeyi ayarlayın veya hala desteklenen 3.7 Flash'ta kalın. API kılavuzu ile başlayın, Apidog'dan ilk isteğinizi jeton sayısı doğrulaması ekleyerek gönderin ve her rota için düşünme seviyesini lansman yazısı değil, rakamlar belirlesin.
