Gemini 3.8 Flash bugün kullanıma sunuldu: Ücretsiz katmanı olan, 2026-12-31 tarihine kadar 1 milyon jeton başına 0,75 dolar giriş ve 3,75 dolar çıkış fiyatıyla, ardından 1,50 dolar ve 7,50 dolar fiyatla, 64K çıkış sınırı olan kararlı bir model. Gemini 4 Argon ise değil. Google'ın tanıtım gönderisi, bunu belirtilmeyen uzunlukta bir giriş döneminde 2 ve 10 dolar, ardından 4 ve 20 dolar olarak fiyatlandırıyor. Google, çıkış sınırının 1 milyon jeton olduğunu ve bugün yalnızca Fairwind Programı savunucularına sunulduğunu belirtiyor. Bu çeyrekte yayın yapmanız gerekiyorsa, Flash'ı kullanın ve Argon'u tek bir yapılandırma değişikliği kadar uzakta tutun.
Bu gönderi, iki modeli özellikler, her iki tanıtım gönderisinde de yer alan kıyaslama satırları, siber puanlar ve özdeş bir çağrının maliyeti açısından karşılaştırır, ardından size bir karar kuralı sunar. Arka plan bilgisi için, Gemini 4 Argon'un ne olduğunu ve Gemini 3.8 Flash'ın ne olduğunu inceleyebilirsiniz. Son bölüm, geçişi tek bir değişken haline getiren Apidog kurulumunu göstermektedir.
Yan yana: Bugün neler çağırabilirsiniz
| Gemini 3.8 Flash | Gemini 4 Argon | |
|---|---|---|
| Kullanılabilirlik | Gemini API, AI Studio, Antigravity ve Gemini Enterprise üzerinde kararlı | Fairwind Programı ortaklarının bir alt kümesine, Gemini Enterprise üzerinde yönetilen bir model olarak |
| Model Kimliği | gemini-3.8-flash |
Yayınlanmadı |
| 1 milyon jeton başına fiyat (giriş / çıkış) | 2026-12-31 tarihine kadar 0,75 $ / 3,75 $, ardından 1,50 $ / 7,50 $ | 2 $ / 10 $ giriş (bitiş tarihi belirtilmedi), ardından 4 $ / 20 $ |
| 1 milyonda önbelleğe alınmış giriş | 0,075 $, ardından 0,15 $ | 0,10 $ giriş, ardından 0,20 $ (girişte %95 indirim) |
| Çıkış sınırı | 65.536 jeton | 1 milyon jeton (Google'ın belirttiği sınır) |
| Giriş penceresi | 1.048.576 jeton | Yayınlanmadı |
| Düşünme seviyeleri | low, medium (varsayılan), high; minimal HTTP 400 döndürür |
Belgelenmemiş |
| Ücretsiz API katmanı | Evet, hız sınırlı | Duyurulmadı |
| Tüketici erişimi | AI Pro ve Ultra'da Gemini uygulaması, Arama'da AI Modu | Henüz değil; AI Ultra aboneleri ilk dalgada, tarih yok |
Birkaç hücrenin bağlama ihtiyacı var. Google, Argon'un kendi uzun bağlam değerlendirmesinde 1 milyon jetona kadar istemler kullanmasına rağmen, giriş penceresini yayınlamadı. Google, Argon'un çıkış sınırının 1 milyon jeton olduğunu söylüyor; en az bir üçüncü taraf değerlendirici olan Vals AI, test ettiği yapılandırma için 262K maksimum çıkış listeliyor. Argon'un değerlendirmeleri "en yüksek düşünme ayarlarıyla" çalıştı, bu nedenle yüksek bir seviye muhtemelen mevcut, ancak Google seviyeleri veya varsayılanı adlandırmadı. Flash'ın seviyeleri Google'ın düşünme belgelerinde ve bizim 3.8 Flash düşünme seviyeleri kılavuzumuzda yer almaktadır.
Flash'ın ücretsiz katmanı hız sınırlıdır ve Google, ücretsiz katman verilerinin "ürünlerimizi iyileştirmek için kullanıldığını" belirtir. Google, Argon'u kullanmanın herhangi bir ücretsiz yolunu açıklamadı; Argon ücretsiz erişim açıklayıcımız bunun yerine ne kullanabileceğinizi kapsar.
Her iki tanıtım gönderisinin de metinde paylaştığı kıyaslama satırları
Google'ın iki model için tanıtım tabloları metinde iki satırı paylaşmaktadır. Bunlar Google tarafından bildirilen sayılardır ve Argon'un metodolojisi her iki satırı da Vals AI'ya atfetmektedir.
| Kıyaslama | Gemini 3.8 Flash (2 Eylül tablosu) | Gemini 4 Argon (30 Eylül tablosu) |
|---|---|---|
| Vals Finans Aracısı v2 | %61,4 | %65,4 |
| Harvey Yasal Aracı Kıyaslaması | %10,0 | %19,6 |
Google bu tabloları bir ay arayla, farklı rakip setlere karşı yayınladı, bu nedenle aradaki farkı kontrollü bir testten ziyade yönsel olarak okuyun. Yine de, yasal satır dikkat çekicidir: Argon'un %19,6'sı, Flash'ın %10,0'unun neredeyse iki katıdır. Finansal fark 4 puandır.
Argon'un tablosundaki diğer her şeyin metinde 3.8 Flash karşılığı yoktur. Google'ın 3.8 Flash tablosu HLE Doğrulanmış verilerini bildiriyordu, Argon'unki ise bunu yapmıyor ve Flash'ın DeepSWE puanı sadece model kartı görsellerinde yer alıyordu. Üçüncü taraf sıralaması olan Arena'nın Metin liderlik tablosunda, ön oylamalarda Argon (Yüksek) 1. sırada yer alırken, Gemini 3.8 Flash (Yüksek) 11. sıradadır. Her satırı kimin ölçtüğünü içeren 19 satırlık Argon tablosunun tamamı Argon kıyaslama analizimizde bulunmaktadır.
Siber: Argon ve 3.8 Flash Siber
DeepMind siber sayfası, Argon'u Flash'ın Fairwind tarafından korunan siber kardeşi Gemini 3.8 Flash Siber ile karşılaştırır:
| Siber değerlendirme | Gemini 4 Argon | Gemini 3.8 Flash Siber |
|---|---|---|
| Gerçek dünya güvenlik açığı keşfi | %85,8 | %71,0 |
| Wiz Sızma Testi Kıyaslaması | %70,9 | %58,2 |
Her iki modelin de erişimi kısıtlıdır. Gemini 3.8 Flash Siber, Gemini Enterprise Ajan Platformunda bir izin listesinin arkasında Genel Kullanıma (GA) sunulmuştur ve Argon sadece Fairwind içindir. Eğer bir Fairwind ortağı değilseniz, bu sayılardan hiçbiri bugün çağırabileceğiniz şeyi değiştirmez. Üzerine inşa edebileceğiniz model, genel 3.8 Flash modelidir.
Her ikisinde de aynı çağrının maliyeti
100.000 giriş jetonu ve 8.000 çıkış jetonu içeren bir çağrı alalım. Mevcut Gemini modelleri, 3.8 Flash dahil, düşünme jetonlarını çıkış olarak faturalandırır, bu nedenle 8.000 rakamı bunları içerir. Google, Argon'un bunları nasıl faturalandırdığını söylemedi; Argon satırları mevcut Gemini modellerini takip ettiğini varsayar.
| Model ve dönem | Giriş maliyeti | Çıkış maliyeti | Çağrı başına toplam |
|---|---|---|---|
| 3.8 Flash, giriş | 0,1M x 0,75 $ = 0,075 $ | 0,008M x 3,75 $ = 0,030 $ | 0,105 $ |
| 3.8 Flash, 2027-01-01'den itibaren | 0,1M x 1,50 $ = 0,150 $ | 0,008M x 7,50 $ = 0,060 $ | 0,210 $ |
| Argon, giriş | 0,1M x 2 $ = 0,200 $ | 0,008M x 10 $ = 0,080 $ | 0,280 $ |
| Argon, standart | 0,1M x 4 $ = 0,400 $ | 0,008M x 20 $ = 0,160 $ | 0,560 $ |
Argon'un jeton başına oranları, hem giriş fiyatlandırmasında hem de standart fiyatlandırmada Flash'ın 8/3'ü (yaklaşık 2.67 katı) kadardır. Günde bu çağrılardan 1.000 tanesi, Flash'ta günde 105 dolar, Argon'da ise giriş fiyatlarıyla 280 dolar demektir.
Üç şey bu düzgün oranı bozar:
- Jeton sayıları eşleşmeyebilir. Aynı istem, farklı modellerde farklı çıktı ve düşünme jeton sayıları üretir. Argon'un yayınlanmış değerlendirmeleri en yüksek düşünme ayarlarında çalıştı ve 3.8 Flash'ta Google, daha yüksek çaba seviyelerinin daha fazla jeton kullanabileceği konusunda uyarıyor.
- Uzun çıktılar hesabı değiştirir. 200.000 jetonluk bir yanıt, Flash'ın 65.536 jetonluk kapasitesine sığmaz, bu yüzden birkaç çağrıya bölmeniz gerekir. Argon'un belirtilen sınırına göre tek bir yanıttır: giriş fiyatlarıyla 0,2M x 10 $ = 2,00 $ veya standart fiyatlarla 4,00 $. Tam 1 milyon jetonluk bir yanıt giriş fiyatıyla 10 $, standart fiyatla ise 20 $ tutar.
- Sadece bir giriş bitiş tarihi biliniyor. Flash'ın giriş fiyatlandırması 2026-12-31'de sona eriyor. Google, Argon'un ne zaman biteceğini belirtmedi.
Flash ayrıca, Gemini API fiyatlandırma sayfasına göre %50 indirimli Toplu İş (31 Aralık'a kadar 0,375 $ ve 1,875 $) sunmaktadır. Google, Argon için Toplu İş fiyatlandırmasını yayınlamadı. Argon fiyatlandırma kılavuzumuz ve 3.8 Flash fiyatlandırma kılavuzumuz daha derinlemesine inceler.
Argon'u mu beklemelisiniz yoksa Flash'ı mı kullanmalısınız?
Şu durumlarda 3.8 Flash'ı hemen kullanın:
- Maliyet kısıtlamalarınız var. Flash, Argon'un jeton başına 3/8'i kadar maliyetlidir ve Toplu İş bunu yarıya indirir.
- Yüksek hacimli çalışıyorsunuz. Büyük ölçekte sınıflandırma, çıkarma, yönlendirme ve sohbet, 1 milyon çıktı jetonu başına 10 dolardan hızla birikir.
- Bugün ihtiyacınız var. Flash'ın kararlı bir model kimliği, prototipleme için ücretsiz bir katmanı ve yayınlanmış bir fiyat çizelgesi var.
- Yanıtlarınız 65.536 jetona sığıyor. Çoğu API iş yükü sığar.
Şu durumlarda Argon'u planlayın:
- Çalışma uzun vadeli ise. Google, Argon'un "karmaşık, uzun vadeli iş akışlarında derinlemesine muhakemeyi sürdürmek için inşa edildiğini" belirtiyor.
- 64K'dan fazla çıktılara ihtiyacınız var. Tam modül yeniden yazımları, uzun raporlar ve büyük geçişler, 1 milyonluk bir çıkış sınırı için geçerlidir.
- Yasal veya finansal aracılar kullanıyorsunuz. Bunlar, Google'ın her iki modeli de yayınladığı iki satır ve Argon her ikisinde de lider.
- Fairwind uygun bir savunucusunuz. Argon, programın şu anda liderliğini yaptığı modeldir.
Bir kez seçmek zorunda değilsiniz. Trafiğin büyük kısmını Flash'a yönlendirin ve Argon yayınlandığında, aynı yapılandırmanın arkasında, zorlu kuyruğu ona gönderin.
Bir kaydedilmiş istek, iki model
İşte kalıp. Model adını bir ortam değişkeninde tutun, gerçek isteklerinizi şimdi 3.8 Flash'a karşı çalıştırın ve Argon'un model kimliği yayınlandığında değişkeni değiştirin. Google bu kimliği yayınlamadı, bu yüzden bir tane tahmin etmeyin.
MODEL="${GEMINI_MODEL:-gemini-3.8-flash}"
curl -s -X POST \
"https://generativelanguage.googleapis.com/v1beta/models/${MODEL}:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"contents":[{"parts":[{"text":"Bu sözleşme maddesini 3 madde halinde özetle."}]}],
"generationConfig":{"thinkingConfig":{"thinkingLevel":"medium"},"maxOutputTokens":8192}}'
Her generateContent yanıtı usageMetadata ile biter. Apidog'da, GEMINI_API_KEY ve GEMINI_MODEL'i bir ortamda saklayın, bu isteği kaydedin ve iddialar ekleyin: durum 200, uygulamanızın okuduğu alanlar ve maliyet sınırınıza göre ayarlanmış usageMetadata.thoughtsTokenCount üzerinde bir tavan. Uzun bir yanıtın bütçenizi aşmasını önlemek için maxOutputTokens'u ayarlı tutun. Bunu bir test senaryosuna ekleyin, Flash'ta çalıştırın ve raporu bir temel olarak saklayın.
Lansman günü için iki uyarı. Google, "tüm yeni modellerin" Interactions API'sinde başlatılacağını ve Argon'un generateContent'i destekleyip desteklemediğini söylemedi, bu yüzden bunun yanına bir Etkileşimler sürümü (generation_config.thinking_level ile POST https://generativelanguage.googleapis.com/v1beta/interactions) kaydedin. Ve Argon'un düşünme seviyesi adları belgelenmediğinden, medium aktarılamayabilir. Argon geldiğinde, bir değişkeni değiştirin, yeniden çalıştırın ve çıktıları ile usageMetadata'yı yan yana karşılaştırın.
Sıkça Sorulan Sorular
Gemini 4 Argon, Gemini 3.8 Flash'tan daha iyi mi? Her iki tanıtım tablosunun da metinde paylaştığı iki satırda evet: Vals Finans Aracısı v2'de %65,4'e karşı %61,4 ve Harvey'in Yasal Aracı Kıyaslamasında %19,6'ya karşı %10,0. Ayrıca jeton başına yaklaşık 2.67 kat daha pahalıdır ve henüz onu çağıramazsınız.
Gemini 4 Argon'u beklemeli miyim? Yayın yapmanız gerekiyorsa hayır. Google herhangi bir yayın tarihi vermedi, sadece ücretli API müşterileri ve AI Ultra aboneleriyle başlayarak "mümkün olan en kısa sürede" dedi.
Yeni bir proje için Gemini 3.8 Flash mı yoksa Argon mu? Modeli bir değişken içinde tutarak 3.8 Flash ile başlayın. Uzun çıktılara veya yasal ve finansal derinliğe ihtiyaç duyan istekleri, kendi istemleriniz üzerinde test ettikten sonra Argon'a taşıyın.
Argon'u ücretsiz kullanmanın bir yolu var mı? Hayır. Google ücretsiz bir katman duyurmadı; bugün kullanabileceğiniz ücretsiz Gemini modelleri için Argon ücretsiz erişim açıklayıcımıza bakın.
Argon, Gemini 3.8 Flash'ın yerini mi alıyor? Google söylemedi. Google, Argon'u yeni sınır modeli olarak adlandırıyor ve Reuters, önceki Pro serisinden daha büyük olduğunu bildiriyor, bu nedenle Flash'tan farklı bir katmandır.
Sonraki adım
İsteği bugün ayarlayın, 3.8 Flash'ta çalıştırın ve raporu kaydedin. Argon yayınlandığında, trafiğinizde fiyatını hak edip etmediğini birkaç dakika içinde anlarsınız. Karşılaştırmayı oluşturmak için Apidog'u indirin.
