Google, 3.6 Flash'tan üç hafta sonra, 13 Ağustos 2026'da Gemini 3.7 Flash'ı piyasaya sürdü ve ona “en akıllı işgücü modelimiz” adını verdi. Bir API faturasını takip eden herkes için en önemli detay, kıyaslama tablolarında değil, fiyatlandırma tablosunda yer alıyor: milyon giriş belirteci başına 0,75 ABD doları ve milyon çıkış belirteci başına 3,75 ABD doları olan tanıtım fiyatı 31 Aralık 2026'da sona eriyor. 1 Ocak 2027'den itibaren her iki oran da iki katına çıkacak.
Bu model üzerine kurduğunuz her iş yükü için planlanmış bir 2 kat artış anlamına geliyor. Bugün ayda 790 ABD doları maliyeti olan bir sohbet robotu, Ocak ayında kodunuzda, trafiğinizde veya istemlerinizde hiçbir değişiklik olmadan ayda 1.575 ABD dolarına mal olacak. Bu nedenle, bir 3.7 Flash projesi bütçelerken, sadece etiket fiyatını değil, her iki fiyatlandırma katmanını da göz önünde bulundurun.
Bu kılavuz, iki fiyatlandırma katmanını, üç gerçek iş yükü için belirteç hesaplamasını, fiyatın diğer model API'lerine karşı nasıl konumlandığını ve fiyat ikiye katlanmadan önce harcamaları nerede kısacağınızı anlatıyor. Henüz ilk isteği göndermediyseniz, Gemini 3.7 Flash API hızlı başlangıcı kurulumu kapsar. Çağrı yapmaya başladığınızda, Apidog her yanıtta usageMetadata belirteç sayılarını gösterir, böylece aşağıdaki her tahmin canlı trafiğe karşı kontrol edebileceğiniz bir sayı haline gelir.
TL;DR
- Tanıtım fiyatı: 1M giriş belirteci başına 0,75 ABD doları ve 1M çıkış belirteci başına 3,75 ABD doları olup, 31 Aralık 2026 tarihine kadar geçerlidir.
- 1 Ocak 2027'den itibaren standart fiyat: 1,50 ABD doları giriş ve 7,50 ABD doları çıkış. Tam olarak iki katı.
- Tanıtım fiyatı, Gemini 3.6 Flash'ın piyasaya sürüldüğündeki maliyetinin yarısıdır.
- Model, 1M belirteçlik bir bağlam penceresinde metin, resim, video, ses ve PDF girişlerini kabul eder ve 64k belirteçlik bir çıkış limiti vardır.
- Uygulamalı örnek: Günde 10.000 istek işleyen bir sohbet robotu, tanıtım fiyatlarıyla günde yaklaşık 26 ABD doları ve standart fiyatlarla günde 52,50 ABD doları maliyetle çalışır.
- Bağlam önbelleğe alma, çıkış limitleri, toplu işleme ve hafif trafiği daha küçük bir modele yönlendirme, harcamaları azaltmanın ana yollarıdır.
İki fiyatlandırma katmanı
Gemini 3.7 Flash, kalıcı bir fiyat yerine zaman sınırlı bir indirimle piyasaya sürüldü. İşte Gemini API için tam tablo:
| Katman | Süre | Giriş (1M belirteç başına) | Çıkış (1M belirteç başına) |
|---|---|---|---|
| Tanıtım | 13 Ağustos 2026 - 31 Aralık 2026 | $0.75 | $3.75 |
| Standart | 1 Ocak 2027'den itibaren | $1.50 | $7.50 |
İki şey öne çıkıyor. Birincisi, tanıtım fiyatı Gemini 3.6 Flash piyasaya sürüldüğündeki maliyetinin yarısıdır, bu da önümüzdeki dört buçuk ayı bu model ailesinin şimdiye kadarki en ucuz penceresi haline getiriyor. 3.6'dan yükseltmeyi düşünüyorsanız, 3.6'dan 3.7 Flash'a geçiş kılavuzu değişimi kapsar; sadece fiyat indirimi regresyon testlerinin maliyetini karşılar.
İkincisi, her iki katmanda da çıkış belirteçleri giriş belirteçlerinin 5 katına mal oluyor. Bu oran, bu kılavuzdaki her optimizasyon kararını şekillendirir: ayrıntılı bir sistem istemini kısaltmak kuruşları kurtarırken, kontrolsüz çıkışı sınırlamak dolarları kurtarır.
Yukarıdaki fiyatlar, bir AI Studio anahtarı aracılığıyla faturalandırılan Gemini API'yi kapsar. Vertex AI, kendi SKU'ları ve kurumsal şartlarıyla Google Cloud faturalandırması üzerinden çalışır ve bağlam önbelleğe alma ve toplu işleme gibi özelliklerin kendi kalemleri vardır, bu nedenle bir bütçe ayırmadan önce resmi fiyatlandırma sayfasındaki güncel sayıları doğrulayın.
Gerçek bir iş yükünün maliyeti nedir
Milyon belirteç başına fiyatlar, onları trafikle çarpmadan hiçbir anlam ifade etmez. İşte varsayımları belirtilmiş üç iş yükü profili, böylece kendi sayılarınızı değiştirebilirsiniz.
İş Yükü 1: Bir müşteri destek sohbet robotu
Günde 10.000 istek varsayın. Her istek yaklaşık 2.000 giriş belirteci (sistem istemi, kısa bir geçmiş penceresi, kullanıcı mesajı) taşır ve yaklaşık 300 çıkış belirteci döndürür.
| Kalem | Günlük belirteçler | Tanıtım maliyeti/gün | Standart maliyet/gün |
|---|---|---|---|
| Giriş | 20M | $15.00 | $30.00 |
| Çıkış | 3M | $11.25 | $22.50 |
| Toplam | 23M | $26.25 | $52.50 |
Bu, 30 günlük bir ayda tanıtım fiyatlarıyla yaklaşık ayda 788 ABD doları ve standart fiyatlarla ayda 1.575 ABD dolarıdır. Konuşma turu başına, bugün yaklaşık çeyrek sent ödüyorsunuz.
İş Yükü 2: Bir PDF belge işlem hattı
Gemini 3.7 Flash PDF'leri doğal olarak okur ve GDP.pdf kıyaslama puanı 3.6 Flash'ın üzerine çıkarak %22,0'dan %34,0'a yükseldi, bu nedenle belge çıkarma Google'ın burada çalıştırmanızı beklediği bir iş yüküdür. Günde 500 belge varsayın; her biri ortalama 40.000 giriş belirteci (uzun bir sözleşme veya rapor) ve 1.000 belirteçlik yapılandırılmış bir özet üretir.
| Kalem | Günlük belirteçler | Tanıtım maliyeti/gün | Standart maliyet/gün |
|---|---|---|---|
| Giriş | 20M | $15.00 | $30.00 |
| Çıkış | 0.5M | $1.88 | $3.75 |
| Toplam | 20.5M | $16.88 | $33.75 |
Şu anda ayda yaklaşık 506 ABD doları, Ocak ayından itibaren 1.013 ABD doları. Şekle dikkat edin: belgeler uzun ve özetler kısa olduğu için giriş belirteçleri baskındır. Önbelleğe alma ve toplu işleme bu iş yükünü en çok etkiler.
İş Yükü 3: Bir aracı döngüsü
Aracılar çağrıları çoğaltır. Günde 200 görev varsayın; her biri ortalama 12 model çağrısı yapar ve her çağrı 8.000 giriş belirteci (artan bağlam artı araç sonuçları) taşır ve 400 çıkış belirteci döndürür.
| Kalem | Günlük belirteçler | Tanıtım maliyeti/gün | Standart maliyet/gün |
|---|---|---|---|
| Giriş | 19.2M | $14.40 | $28.80 |
| Çıkış | 0.96M | $3.60 | $7.20 |
| Toplam | 20.16M | $18.00 | $36.00 |
Tanıtım fiyatlarıyla ayda 540 ABD doları, standart fiyatlarla 1.080 ABD doları. Aracı faturalandırmasından çıkarılacak ders: bağlam her adımda büyür, bu nedenle çağrı sayısı ve bağlam uzunluğu birleşir. 12 çağrıdan 20 çağrıya çıkan bir görev size %67 daha fazlaya mal olur ve fiyatlandırma tablosunda sizi hiçbir şey uyarmadı.
Aklınızda tutmaya değer bir sayı daha: 64 binlik çıkış sınırı, çağrı başına en kötü senaryonuzu bugün yaklaşık 0,24 ABD doları ve gelecek yıl 0,48 ABD doları ile sınırlar. Her denemede çıktıyı maksimize eden bir yeniden deneme döngüsü hızla pahalı hale gelir, ancak sınırsızca pahalı hale gelemez.
3.7 Flash fiyatlandırması nasıl karşılaştırılır
Sağlayıcılar arasındaki kesin belirteç başına karşılaştırmalar haftalar içinde geçerliliğini yitirir, bu nedenle bunu bir fiyat listesi olarak değil, bir konumlandırma olarak değerlendirin.
Gemini 3.7 Flash, işgücü katmanında yer alıyor: Gemini'nin kendi Pro serisi, Claude'un daha büyük modelleri veya OpenAI'nin amiral gemisi katmanı gibi öncü modellerden çok daha ucuz, ancak amiral gemisi modellerin yakın zamanda elde ettiği kıyaslama puanlarıyla (DeepSWE v1.1'de %65,3, 1588 WebDev Arena Elo) örtüşen puanlar taşıyor. Google'ın tahmini, çoğu üretim trafiğinin öncü bir modele ihtiyaç duymadığı ve tanıtım indirimi, bu iddiayı kendi iş yükünüzde test etmek için dört aylık bir davet olduğu yönünde.
Rekabet ortamı da önemlidir. Bütçe katmanı sağlayıcıları fiyatları diğer yöne doğru hareket ettiriyor; DeepSeek API oranlarını yükseltti ve ekipleri belirteç bütçelerini yeniden düşünmeye itti, bu hikaye DeepSeek fiyat artışı ve maliyet optimizasyon kılavuzunda ele alındı. Bu çıkarım doğrudan Gemini'ye aktarılabilir: marj oluşturduğunuz her fiyat değişebilir ve Google size tarihi ve miktarı zaten söyledi. Bu, çoğu sağlayıcının verdiğinden daha fazla bir uyarıdır.
Trafiğiniz ani veya deneyselse, fiyatın ikiye katlanmasının yalnızca sürekli iş yüklerini etkilediğini unutmayın. Tanıtım penceresi sırasında 3 ABD doları maliyeti olan bir prototip daha sonra 6 ABD dolarına mal olur. Kimse umursamaz. Ayda 10.000 ABD doları olan bir işlem hattının 20.000 ABD doları olması, finans ekibinizin Şubat ayında soracağı bir kalem olacaktır.
Belirteç harcamasını azaltmanın beş yolu
5 kat çıkış-giriş fiyat oranı ve Ocak ayındaki ikiye katlama, aynı kaldıraç grubunu işaret ediyor.
- Uç nokta başına çıkış belirteçlerini sınırlayın. `generationConfig` içindeki `maxOutputTokens` değerini her uç noktanın ihtiyaç duyduğu en küçük değere ayarlayın. Bir destek yanıtı nadiren 500 belirteçten fazlasına ihtiyaç duyar; sınırı 64k varsayılanda bırakmak, bir karmaşık üretimin normal bir tanesinin 100 katına mal olabileceği anlamına gelir. Bu, çıkış belirteçleri 5 kat çarpan taşıdığı için en yüksek getirili tek değişikliktir.
- Statik bağlamınızı önbelleğe alın. Her istek aynı 3.000 belirteçlik sistem istemini ve politika belgesini yeniden gönderiyorsa, aynı baytlar için günde binlerce kez tam giriş fiyatı ödüyorsunuz demektir. Bağlam önbelleğe alma, tekrarlanan belirteçleri indirimli bir oranda faturalandırır; mevcut önbelleğe alma kurulumu ve oranları için Gemini API belgelerini kontrol edin. Yukarıdaki sohbet robotu için, 1.500 belirteçlik statik bir öneki önbelleğe almak, giriş faturasını yarıya yakınının çoğu kadar azaltır.
- Etkileşimli olmayan işleri toplu işleyin. Belge işlem hattının saniyenin altında yanıt vermesi gerekmez. Toplu işleme, gecikmeyi indirimli bir oranla değiştirir ve gecelik belge çalıştırmaları tam da bunun için var olan trafik şeklidir.
- Rota başına modeli doğru boyutlandırın. Her çağrının 3.7 Flash'a ihtiyacı yoktur. Sınıflandırma, yönlendirme ve kısa çıkarma görevleri genellikle bir Flash-Lite katmanı modelinde maliyetin bir kısmı karşılığında iyi çalışır. 3.7 Flash'ı, ödediğiniz şeyi kullanan çağrılar için saklayın: çok adımlı planlama, hata ayıklama, araç çağrı zincirleri.
- Ücretsiz katmanda prototip oluşturun. AI Studio'nun ücretsiz kotası, tek bir faturalandırılmış belirteç gönderilmeden önce istemleri ve yanıt şemalarını kilitlemek için yeterlidir. Ücretsiz Gemini API erişim kılavuzu, ücretsiz yolun ne kadar uzandığını ve sınırlamalarının nerede olduğunu kapsar.
Apidog ile uç nokta başına harcamayı takip edin
Tahminler size bir bütçe sağlar; istek başına ölçüm sizi bu bütçenin içinde tutar. Her Gemini yanıtı, istem ve çıkış belirteç sayılarını içeren bir usageMetadata bloğu içerir, bu da API test katmanınızın bir maliyet ölçer olarak ikiye katlanabileceği anlamına gelir.
Apidog'da iş akışı şöyle görünür:
- Üretim uç noktası başına (sohbet sırası, belge özeti, aracı adımı) bir isteği, API anahtarını bir `GEMINI_API_KEY` ortam değişkenine bağlayarak bir koleksiyonda kaydedin.
- Her isteği gerçekçi yüklerle tetikleyen ve yanıttan `usageMetadata.promptTokenCount` ve `usageMetadata.candidatesTokenCount` değerlerini çıkaran bir test senaryosu oluşturun.
- Bu sayılar üzerinde onaylamalar ekleyin. Örneğin, bir istem düzenlemesi sohbet uç noktasını 2.500 giriş belirtecini aşarsa, değişiklik gönderilmeden önce senaryo başarısız olur ve faturanızı %25 oranında sessizce artırır.
- Her istem veya şema değişikliğinde senaryoyu yeniden çalıştırın. Belirteç sayıları gecikme gibi geriler; fark şudur ki belirteç gerilemeleri bir fatura olarak gelir.
Ölçülen sayıları bu kılavuzdaki katman fiyatlarıyla çarpın, böylece tahminler yerine gerçek yanıtlara dayalı uç nokta başına maliyet rakamlarına sahip olursunuz. Doğrulama tabanlı API paketlerini zaten kullanan ekipler bu deseni tanıyacaktır; QA mühendisleri için API test kılavuzu, bu tür senaryoların bir hizmet genelinde nasıl yapılandırılacağını kapsar.
Sıkça Sorulan Sorular
Gemini 3.7 Flash fiyatlandırması ne zaman ikiye katlanacak?
1 Ocak 2027'de. 1M giriş belirteci başına 0,75 ABD doları ve 1M çıkış belirteci başına 3,75 ABD doları olan tanıtım fiyatı 31 Aralık 2026'ya kadar geçerlidir, ardından 1,50 ABD doları ve 7,50 ABD doları standart oranına geçer. Google, her iki katmanı da lansmanda yayınladı, bu nedenle artış spekülatif değil, planlıdır.
Gemini 3.7 Flash, Gemini 3.6 Flash'tan daha mı ucuz?
Lansmanda, evet. 3.7 Flash tanıtım fiyatı, 3.6 Flash'ın lansman fiyatının yarısıdır, bu arada kıyaslama puanları genel olarak iyileşti (DeepSWE v1.1 %49,0'dan %65,3'e yükseldi). Yan yana karşılaştırma yapmak isterseniz, tam özellikler ve kıyaslama tabloları Gemini 3.7 Flash hızlı referansında bulunur.
Tanıtım fiyatı Vertex AI için de geçerli mi?
Bu kılavuzdaki oranlar, bir AI Studio anahtarı aracılığıyla faturalandırılan Gemini API oranlarıdır. Vertex AI, kendi SKU'ları ve kurumsal şartlarıyla Google Cloud üzerinden faturalandırılır. Vertex'te üretim trafiği çalıştırıyorsanız, eşitlik varsaymak yerine GCP faturalandırma konsolunuzdaki ve resmi fiyatlandırma sayfasındaki güncel sayıları doğrulayın.
Giriş belirteci faturasına neler dahil edilir?
Gönderdiğiniz her şey: metin, görüntüler, videolar, sesler ve PDF sayfalarının hepsi belirteçlere dönüştürülür ve giriş oranından faturalandırılır. Uzun belgeler ve medya ağırlıklı istekler, giriş maliyetlerinin insanları şaşırtabileceği yerlerdir, bu nedenle yukarıdaki işlem hattı örneği belge başına 40.000 belirteç varsayar. Her yanıttaki `usageMetadata` bloğu, işlemden sonra size kesin sayıyı söyler.
Bir istek göndermeden önce belirteçleri nasıl tahmin edebilirim?
API'nin `countTokens` uç noktasını kullanarak hiçbir şey üretmeden bir yükü ölçün veya birkaç temsili istek gönderin ve yanıtlardan `usageMetadata`'yı okuyun. Her iki durumda da gerçek yüklerle ölçüm yapın. Diğer sağlayıcılardan gelen belirteçleyici sezgisi, model aileleri arasında kötü aktarılır.
3.7 Flash yığınınıza nerede uyar
Tanıtım fiyatlandırmasıyla Gemini 3.7 Flash, bu kadar yetenekli bir modelin şimdiye kadar olduğu en ucuz fiyattır ve Google size bunun ne zaman sona ereceğini tam olarak söyledi. Mantıklı hareket: iş yükü trafiğinizi şimdi ona taşıyın, indirim devam ederken uç nokta başına gerçek belirteç tüketimini ölçün ve bu dört aylık verileri kullanarak 3.7 Flash'ta nelerin kalacağına, nelerin daha hafif bir modele geçeceğine ve standart fiyatlı faturanın gelmeden önce nasıl görüneceğine karar verin.
Bu planın ölçüm yarısı araç gerektirir. Gemini isteklerinizi, ortamlarınızı, belirteç onaylamalarınızı ve maliyet kontrollerinizi tek bir çalışma alanında tutmak için Apidog'u indirin, böylece Ocak faturası keşfettiğiniz bir sayı yerine tahmin ettiğiniz bir sayı olur.
