Gemini 4 Argon, giriş dönemi boyunca 1 milyon giriş belirteci (input token) başına 2 dolar ve 1 milyon çıkış belirteci (output token) başına 10 dolar, ardından 4 dolar ve 20 dolar maliyete sahip. Önbelleğe alınmış giriş (cached input) ise giriş fiyatının %95 indirimli haliyle, yani giriş döneminde 1 milyon belirteç başına 0,10 dolar ve sonrasında 0,20 dolar. Google, giriş döneminin ne kadar süreceğini henüz belirtmedi ve Argon'u henüz satın alamıyorsunuz: duyuruldu ancak genel kullanıma açık değil ve bugün sadece Fairwind Programı siber savunucularına sunuluyor.
Bu gönderi, o fiyat listesini bütçe sayılarına dönüştürüyor: yedi güncel modelle karşılaştırma, dört uygulanmış senaryo, görev başına üçüncü taraf maliyeti ve şimdi kurulacak maliyet kontrolleri. Modelin kendisi için, Gemini 4 Argon nedir ile başlayın; erişim için Gemini 4 Argon ücretsiz mi kısmına bakın. Bugün çağırabileceğiniz bir modele karşı Apidog'da maliyet iddiaları oluşturabilir ve model adını daha sonra değiştirebilirsiniz.

Fiyat listesi
Google, fiyatları Gemini 4 Argon tanıtım gönderisinde yayınladı; giriş sonrası oran dipnot 1'de belirtilmiştir: "Giriş süresi sona erdikten sonra, 1 milyon giriş belirteci başına 4 dolar ve 1 milyon çıkış belirteci başına 20 dolar fiyat uygulanacaktır."
| Gemini 4 Argon, 1 milyon belirteç başına | Giriş | Standart (giriş sonrası) |
|---|---|---|
| Giriş | $2.00 | $4.00 |
| Önbelleğe alınmış giriş (girişin %95 indirimli hali) | $0.10 | $0.20 |
| Çıkış | $10.00 | $20.00 |
| Yanıt başına maksimum çıkış (Google) | 1 milyon belirteç | 1 milyon belirteç |
| Bir tam 1 milyon belirteçlik çıkışın maliyeti | $10.00 | $20.00 |
Önbelleğe alınmış oranlar, Google'ın %95 kuralından (%2 x 0,05 ve %4 x 0,05) aritmetik olarak türetilmiştir. Google henüz bir giriş bağlam penceresi veya bir model kimliği yayınlamadı. Çıkış limitinin 1 milyon belirteç olduğunu belirtiyor, "önceki 64K belirteçten artırıldı"; en az bir üçüncü taraf değerlendirici olan Vals AI, test ettiği yapılandırma için 262K maksimum çıkış listeliyor.
Argon ve mevcut öncü ve Gemini modelleri karşılaştırması
Tüm fiyatlar 1 milyon belirteç başınadır.
| Model | Giriş | Önbelleğe alınmış giriş | Çıkış | Maks. çıkış |
|---|---|---|---|---|
| Gemini 4 Argon (giriş) | $2 | $0.10 | $10 | 1 milyon |
| Gemini 4 Argon (standart) | $4 | $0.20 | $20 | 1 milyon |
| GPT-6 Astra | $10 | $1 | $50 | 128.000 |
| Claude Opus 5.5 | $4 | $0.20 | $20 | 128K (Batch'te 300K, beta) |
| Claude Sonnet 5.5 | $2 | $0.20 | $10 | 128K (Batch'te 300K, beta) |
| GPT-6.1 Sol | $2 | $0.10 | $10 | 128.000 |
| Claude Fable 5.1 | $10 | $0.25 | $50 | 128K |
| gemini-3.1-pro-preview (istem <=200K / >200K) | $2 / $4 | $0.20 / $0.40 | $12 / $18 | 65.536 |
| gemini-3.8-flash (giriş / 2027-01-01'den itibaren) | $0.75 / $1.50 | $0.075 / $0.15 | $3.75 / $7.50 | 65.536 |
Rakip fiyatlar satıcıların kendi sayfalarından alınmıştır: OpenAI'nin GPT-6 Astra sayfası, Anthropic'in fiyatlandırma sayfası ve Google'ın Gemini API fiyatlandırma sayfası.
- Standart Argon = Claude Opus 5.5. Aynı $4/$20, aynı $0,20 önbelleğe alınmış giriş.
- Giriş Argon = Claude Sonnet 5.5 ve GPT-6.1 Sol. Aynı $2/$10; $0,10 giriş önbellek oranı GPT-6.1 Sol ile eşleşiyor.
- GPT-6 Astra ve Claude Fable 5.1, giriş Argon'un 5 katı ve standart Argon'un 2,5 katı maliyete sahiptir. Claude Fable 5.1 fiyatlandırması'na bakın.
- Argon'un giriş çıkışı ($10), Google'ın önceki en iyi Pro modeli olan gemini-3.1-pro-preview'ın ($12) altındadır.
- Uzun istemler matematiği değiştirir. OpenAI, 272K giriş belirtecini aşan istemleri tam istek için 2 kat giriş ve önbellek ve 1,5 kat çıkış olarak faturalandırır. Gemini 3.1 Pro 200K üzerindeki istemler için daha fazla ücret alır; Anthropic almaz. Google, Argon'un uzun istem katmanına sahip olup olmadığını belirtmedi.
Fiyatın yanı sıra yetenek için, Gemini 4 Argon vs GPT-6 Astra vs Claude Opus 5.5 bölümüne bakın.
Düşünme belirteçleri çıkış olarak faturalandırılır
Mevcut Gemini modellerinde, düşünme belirteçleri çıkış olarak faturalandırılır: Google'ın düşünme belgeleri "yanıt fiyatlandırmasının çıkış belirteçleri ve düşünme belirteçlerinin toplamı" olduğunu belirtir. Google, Argon'u özel olarak belgelememiştir, ancak aynı kuralın geçerli olduğunu varsayın. Google, Argon'un değerlendirmelerini "en yüksek düşünme ayarlarıyla" çalıştırdı, bu nedenle "1 milyon çıkış belirteci başına 10 dolar"ı yanıt artı muhakeme olarak okuyun.
Dört uygulanmış senaryo
Aşağıdaki her rakam, belirteçlerin 1 milyona bölünmesi ve 1 milyon başına oranla çarpılmasıyla elde edilir. 1'den 3'e kadar olan senaryolar önbelleğe alma olmadığını varsayar.
1. Tipik bir API çağrısı: 20K giriş, 5K çıkış
- Giriş: 20.000 / 1 milyon x 2 dolar = 0,04 dolar giriş, artı 5.000 / 1 milyon x 10 dolar = 0,05 dolar çıkış. Toplam 0,09 dolar.
- Standart: 0,08 dolar + 0,10 dolar = 0,18 dolar.
Günde 1.000 çağrı yapıldığında, bu giriş fiyatıyla 90 dolar veya standart fiyatla 180 dolar eder. Aynı çağrı Claude Opus 5.5'te 0,18 dolar, GPT-6 Astra'da 0,45 dolar (0,20 dolar + 0,25 dolar), gemini-3.1-pro-preview'da 0,10 dolar (0,04 dolar + 0,06 dolar) ve gemini-3.8-flash'ın giriş fiyatıyla yaklaşık 0,034 dolara (0,015 dolar + 0,019 dolar) mal olur.
2. Uzun bir aracı dönüşü: 200K giriş, 50K çıkış
- Giriş: 200.000 / 1 milyon x 2 dolar = 0,40 dolar, artı 50.000 / 1 milyon x 10 dolar = 0,50 dolar. Toplam 0,90 dolar.
- Standart: 0,80 dolar + 1,00 dolar = 1,80 dolar.
GPT-6 Astra 4,50 dolar (2,00 dolar + 2,50 dolar) ücret alırdı. gemini-3.1-pro-preview 1,00 dolar (0,40 dolar + 0,60 dolar) ücret alır, ancak 200K onun kademe sınırı: daha uzun istemler 4 dolar / 18 dolar olarak faturalandırılır. Eğer Argon benzer bir kademeye sahip olursa, daha uzun dönüşler daha pahalıya mal olur.
3. Tek bir maksimum yanıt: 1 milyon belirteçlik çıkış
Sadece çıkış, giriş fiyatıyla 1.000.000 / 1 milyon x 10 dolar = 10,00 dolar ve standart fiyatla 20,00 dolardır. 100K belirteçlik bir istem ($0,20 giriş, $0,40 standart) eklendiğinde, çağrı 10,20 dolar veya 20,40 dolara mal olur.
Tablodaki başka hiçbir model bunu tek bir senkronize yanıtta üretemez: rakipler 128K ile sınırlıdır, önceki Gemini Pro 65.536 ile. Vals'in listelediği 262K maksimum çıkışta, tam bir yanıt giriş fiyatıyla yaklaşık 2,62 dolar veya standart fiyatla 5,24 dolara mal olur. Mühendislik tarafı (zaman aşımları, akış, ağ geçitleri) Gemini 4 Argon'un 1 milyon çıkış belirteçleri bölümündedir.
4. Önbelleğe alınmış 500K belirteçlik bir istemin 10 kez yeniden kullanılması
Aynı 500K belirteçlik kod tabanını veya sözleşme setini on kez gönderdiğinizi ve her birinde 5K belirteçlik çıkış aldığınızı varsayalım. İlk çağrının önbelleği oluşturmak için tam giriş fiyatını ödediğini ve sonraki dokuz çağrının önbellekten okuduğunu varsayalım.
| 10 çağrı, 500K istem, her biri 5K çıkış | Giriş | Standart |
|---|---|---|
| Giriş, önbelleğe alma yok (10 x 500K) | $10.00 | $20.00 |
| Giriş, önbelleğe alınmış (1 tam + 9 önbelleğe alınmış) | $1.00 + 9 x $0.05 = $1.45 | $2.00 + 9 x $0.10 = $2.90 |
| Çıkış (10 x 5K) | $0.50 | $1.00 |
| Önbelleğe alma ile toplam | $1.95 | $3.90 |
| Önbelleğe alma olmadan toplam | $10.50 | $21.00 |
Önbelleğe alma, giriş faturasını %85,5 oranında düşürür. İki uyarı: Google, Argon'un önbellek depolama için ücret alıp almadığını belirtmedi (gemini-3.1-pro-preview, saatte 1 milyon belirteç başına 4,50 dolar ücret alır, bu da 500K belirteci bir saat tutmak için 2,25 dolar eklerdi) ve 500K'lık bir istem, 3.1 Pro'nun 200K sınırını aşar. Argon'un standart önbelleğe alınmış oranı Opus 5.5'in 0,20 dolarıyla eşleşir, bu nedenle Claude Opus 5.5 istem önbellekleme maliyet matematiği'ndeki başa baş mantığı geçerliliğini korur.
Belirteç başına fiyat, görev başına maliyet değildir
Artificial Analysis, Gemini 4 Argon (Yüksek) üzerinde Inteligent Index'ini çalıştırmak için giriş fiyatlarıyla görev başına 1,99 dolar listeler; The Decoder ise aynı çalıştırmayı standart fiyatlarla görev başına 3,98 dolar olarak belirtir. AA, Argon'u 53 puanla, GPT-6 Astra (maks) ile aynı puanlar ve GPT-6 Astra'yı görev başına 3,26 dolar olarak listeler.
İşin püf noktası belirteç hacmidir. AA, Argon (yüksek) için görev başına yaklaşık 62K çıkış belirteci sayarken, Astra için maksimum ayarında yaklaşık 27K, yani yaklaşık 2,3 kat daha fazladır. Giriş fiyatıyla görev başına çıkış: 62.000 / 1 milyon x 10 dolar = 0,62 dolar, Astra için 27.000 / 1 milyon x 50 dolar = 1,35 dolar. Standart fiyatla, The Decoder'ın Argon için tam görev rakamı (3,98 dolar), Argon'un standart oranları Astra'nın %60 altında olmasına rağmen, AA'nın Astra (maks) için 3,26 dolarının üzerindedir.
Vals AI da aynı modeli gösteriyor. Vals Index'te Argon için test başına 15,68 dolar listelerken, Claude Opus 5.5 için 32,14 dolar, Claude Sonnet 5.5 için 21,34 dolar ve GPT-6.1 Sol için 3,24 dolar listeliyor ve Argon'u 4 dolar/20 dolar standart oranında listeliyor. Sonnet 5.5 ve GPT-6.1 Sol kağıt üzerinde Argon'un giriş fiyatını paylaşsa da, test başına maliyetleri 6 kattan fazla farklılık gösteriyor.
Bütçeyi kendi belirteç sayılarınızdan yapın, fiyat listesinden değil.
Argon piyasaya sürülmeden önce kurulacak maliyet kontrolleri
- Çıkışı sınırlayın. generateContent'te,
generationConfig.maxOutputTokensbir üst sınır belirler. Google, yeni modellerin Interactions API'sinde piyasaya sürüldüğünü söylüyor, bu yüzden Argon için belgelerde listelendiğinde eşdeğer sınırı orada ayarlayın. 1 milyonluk bir üst sınır, standart oranlarda çağrı başına 20 dolarlık bir çıkış üst sınırı demektir. - Sabit içeriği önbelleğe alın. Sistem talimatları, şemalar ve çağrılar arasında tekrarlayan referans belgeleri, %95 indirimin karşılığını verdiği yerlerdir.
- Düşünme seviyesini bilerek seçin. Google, Argon'un seviyelerini yayınlamadı. Bugün gemini-3.1-pro-preview varsayılan olarak
yüksek, gemini-3.8-flash iseortaseviyededir. Argon'un seviyeleri belgelendiğinde, daha düşük bir seviyenin görevlerinizde kaliteyi koruyup korumadığını test edin. - Kullanım hakkında iddia. Her generateContent yanıtı
usageMetadataile biter. Apidog'da, modeli birGEMINI_MODELortam değişkeninde içeren isteği kaydedin,usageMetadata'daki belirteç sayılarından maliyeti hesaplayan bir yanıt sonrası iddia ekleyin ve bir çağrı üst sınırınızı aştığında testi başarısız olarak işaretleyin. Bugün gemini-3.8-flash'a karşı çalıştırın; Argon'un kimliği piyasaya sürüldüğünde, bir değişkeni değiştirin ve paketi yeniden çalıştırın.
Bu iddianın aritmetiği:
maliyet = önbelleğe alınmamış_giriş / 1.000.000 x giriş_oranı
+ önbelleğe_alınmış_giriş / 1.000.000 x önbellek_oranı
+ (çıkış + düşünme) / 1.000.000 x çıkış_oranı
Google'ın henüz fiyatlandırmadığı şeyler
Giriş döneminin süresi ve 4 dolar/20 doların başlayacağı tarih; 200K üzerindeki istemlerin daha pahalı olup olmadığı; Toplu (Batch) veya Esnek (Flex) fiyatlandırma (3.1 Pro'da her ikisi de vardır, 1 dolar/2 dolar giriş ve 6 dolar/9 dolar çıkış); önbellek depolama ücretleri; hız limitleri; ve hiç ücretsiz bir katman olup olmadığı.
Sıkça Sorulan Sorular
Gemini 4 Argon'un 1 milyon belirteç başına maliyeti ne kadar? Giriş döneminde 2 dolar giriş ve 10 dolar çıkış, ardından 4 dolar ve 20 dolar. Önbelleğe alınmış giriş %95 indirimli: 0,10 dolar, ardından 0,20 dolar.
Giriş fiyatı ne kadar sürer? Google belirtmedi. Tanıtım gönderisinde bitiş tarihi veya süresi yok.
Düşünme belirteçleri çıkış olarak faturalandırılır mı? Mevcut Gemini modellerinde evet. Google, Argon'un kurallarını özel olarak belgelememiştir.
1 milyon belirteçlik bir çıkış yanıtı ne kadara mal olur? Giriş fiyatıyla 10 dolar ve standart fiyatla 20 dolar, giriş hariç.
Argon, Claude Opus 5.5 veya GPT-6 Astra'dan daha mı ucuz? Belirteç başına, standart Argon, Opus 5.5'e eşittir ve Astra'nın %60 altındadır. Görev başına, belirteç hacmine bağlıdır: Artificial Analysis, Argon'u Astra'nın çıkış belirteçlerinin yaklaşık 2,3 katı kadar kullanarak ölçmüştür. Daha ucuz bir Gemini için bugün Gemini 3.8 Flash fiyatlandırmasına bakın.
Argon için bugün ödeme yapabilir miyim? Hayır. Yalnızca Fairwind Programı ortaklarına sunuluyor. Ücretli API müşterileri ve Google AI Ultra aboneleri daha sonra gelecek, ancak tarihi belirtilmedi.
Şimdi bütçeleyin, sonra ölçün
Mevcut trafiğinizin belirteç sayılarını 2 dolar/10 dolar ve 4 dolar/20 dolar ile çarpın, Argon'un giriş ve standart aralığını elde edersiniz. Ardından ölçümü oluşturun: Apidog'u indirin, isteğinizi GEMINI_MODEL'i bir değişken olarak kullanarak gemini-3.8-flash'a karşı kaydedin ve usageMetadata üzerinde bir maliyet iddiası ekleyin. Google model kimliğini yayınladığında, bir değeri değiştirir ve ilk günden gerçek çağrı başına maliyetinizi görürsünüz.
