Gemini 4 Argon, GPT-6 Astra, Claude Opus 5.5 ve Claude Fable 5.1'e karşı 19 satırın 13'ünde Google'ın karşılaştırma tablosunda lider olsa da, tek bir gerçek her puanın önüne geçiyor: Astra ve Opus 5.5'i bugün satın alabilirsiniz, ancak Argon'u satın alamazsınız. Google'ın yeni öncü modeli bugün yalnızca Fairwind Programı savunucularına, tanıtım dönemi boyunca milyon belirteç başına 2$/10$ ve sonrasında 4$/20$ karşılığında sunuluyor, bu da Opus 5.5'in tam olarak maliyeti.
Bu karşılaştırma, dört modeli fiyat ve limitler açısından hizalar, karşılaştırma satırlarını hangi modelin kazandığına göre gruplandırır, sayıların neden birbiriyle tutarlı olmadığını açıklar ve bir yönlendirme kılavuzu ve Apidog'da kendi komut istemlerinizde üçünü de test etme yoluyla sona erer. Argon'a yeni misiniz? Gemini 4 Argon nedir ile başlayın; zamanlama için Argon çıkış tarihi kılavuzuna bakın.
Fiyat ve limitler yan yana
Google'ın tablosu Claude Fable 5.1'i de içeriyor, bu yüzden o da bir sütun alıyor. Fiyatlar 1M belirteç başına olup, her satıcının kendi sayfasından alınmıştır: Google'ın lansman gönderisi, OpenAI'ın GPT-6 Astra model sayfası ve Anthropic'in fiyatlandırma sayfası.
| Gemini 4 Argon | GPT-6 Astra | Claude Opus 5.5 | Claude Fable 5.1 | |
|---|---|---|---|---|
| Bugün arayabilir misiniz? | Hayır, sadece Fairwind | Evet | Evet | Evet |
| API model kimliği | Yayınlanmadı | gpt-6-astra |
claude-opus-5-5 |
claude-fable-5-1 |
| Giriş | 2$ tanıtım, sonra 4$ | 10$ | 4$ | 10$ |
| Önbelleğe alınmış giriş | 0.10$ tanıtım, sonra 0.20$ | 1$ | 0.20$ | 0.25$ |
| Çıkış | 10$ tanıtım, sonra 20$ | 50$ | 20$ | 50$ |
| Maksimum çıkış | 1M (Google'ın belirtilen limiti) | 128K | 128K (Batch'te 300K, beta) | 128K |
| Bağlam penceresi | Yayınlanmadı | 1.050.000 (maksimum 922K giriş) | 1M | 1M |
| Uzun komut istemi ek ücreti | Belirtilmedi | 272K giriş üzeri: tüm istek için 2x giriş ve önbellek, 1.5x çıkış | Yok | Yok |
Üç şey dikkat çekiyor. Argon'un standart fiyatı, giriş, önbelleğe alınmış giriş ve çıkışta Opus 5.5 ile eşleşiyor, bu nedenle Anthropic üzerindeki fiyat avantajı sadece tanıtım dönemi kadar sürüyor ve Google bunu henüz açıklamadı. Astra ve Fable 5.1, Argon'un standart giriş ve çıkış oranlarının 2.5 katı ve tanıtım oranlarının 5 katı fiyatlandırılıyor. Ve 1M çıkış rakamı Google'a ait: Vals AI, test ettiği Argon yapılandırması için 262K'lık maksimum bir çıkış listeliyor. İstek başına maliyet hesaplaması için Gemini 4 Argon fiyatlandırmasına bakın.
Google'ın tablosunda her modelin lider olduğu yerler
Sayılar öncesi: bu Google'ın tablosu. Argon'un puanları Google tarafından raporlanmıştır, bazıları kendi kendine hesaplanmış, bazıları liderlik tablolarından alınmıştır; rakip puanları çoğunlukla satıcıların kendi rakamları veya kamu liderlik tablosu sonuçlarıdır, mevcut olduğunda maksimum muhakeme ayarlarında. Test ortamları farklılık gösterir, bu nedenle küçük farkları gürültü olarak okuyun.
| Lider Kim | Kıyaslama | Argon | Astra | Fable 5.1 | Opus 5.5 |
|---|---|---|---|---|---|
| Argon: bilgi işi | Vals Endeksi | %68,9 | %63,1 | %65,8 | %67,0 |
| Argon: bilgi işi | AutomationBench | %51,3 | %41,4 | %31,4 | %42,5 |
| Argon: bilgi işi | Harvey'in Hukuk Temsilcisi Kıyaslaması | %19,6 | %5,4 | %6,7 | %3,8 |
| Argon: kodlama | DeepSWE v1.1 | %77,9 | %74,1 | %67,4 | %74,2 |
| Argon: uzun bağlam | GraphWalks 256K'dan 1M'ye (F1) | %84,2 | %71,8 | %65,0 | %66,8 |
| Argon: çok modlu | LVBench | %91,7 | %87,5 | %79,7 | %83,7 |
| Argon: çok modlu | Chartography | %71,6 | %71,0 | %46,2 | %66,3 |
| Astra | FrontierSWE v2 | %55,0 | %65,5 | %56,3 | %62,3 |
| Astra | Terminal-Bench Bilim 0.1 | %57,6 | %68,1 | bildirilmedi | bildirilmedi |
| Astra | OSWorld-2.0 (çevrimdışı, kısmi) | %69,2 | %72,6 | bildirilmedi | bildirilmedi |
| Opus 5.5 | Terminal-bench 4.0 | %57,4 | %58,2 | %57,9 | %66,4 |
| Opus 5.5 | PostTrainBench | %45,3 | %44,3 | %40,2 | %49,3 |
| Berabere | CWE-bench v1 | %68,0 | %68,0 | %58,0 | %67,0 |
Argon'un diğer doğrudan galibiyetleri Vals Finans Temsilcisi v2, Vibe Code Bench, LABBench 2, RiemannBench, 128K'ya kadar GraphWalks ve Agent's Last Exam'dır. Fable 5.1 hiçbir satırda lider değildir. CWE-bench v1'de, DeepMind'ın siber liderlik tablosu, Argon, Astra ve Grok 4.7 arasında %68'de üç yönlü bir beraberlik gösteriyor, Opus 5.5 ise %67'de.
Gemini 4 Argon'a karşı Fable 5.1'de, Argon, her ikisinin de bir sayı bildirdiği 17 satırın 15'inde daha yüksek puan alıyor; Fable, yalnızca FrontierSWE v2 (%56,3'e karşı %55,0) ve Terminal-bench 4.0'da (%57,9'a karşı %57,4) önde. Anthropic'in kendi rakamları Claude Fable 5.1 kıyaslama yazımızda, ve tam 19 satırlık tablo Gemini 4 Argon kıyaslamalarında bulunuyor.
Farklara güvenmeden önce üç uyarı
Rakip sayıları Google'ın testleri değildir. Google'ın metodolojisi, Gemini olmayan modellerin sonuçlarının "aksi belirtilmedikçe sağlayıcıların kendi bildirdiği sayılardan alındığını" belirtir ve bazı satırlar Vals AI, Proximal ve Surge tarafından yürütülen kamu liderlik tablolarından gelmektedir.
Test ortamları farklılık gösterir. DeepSWE v1.1'de Google, Argon'un %77,9'unu mini-swe-agent test ortamıyla kendi kendine hesaplarken, Astra'nın puanı kamu liderlik tablosundan, Anthropic puanları ise sistem kartlarından gelir. LVBench'te Gemini, videoyu saniyede 1 kare örneklerken, Astra 800 kare, Opus 5.5 600 ve Fable 5.1 300 kare aldı, "API sınırlamaları nedeniyle."
Aynı model, farklı grafiklerde farklı puanlar alır. Opus 5.5'in Terminal-bench 4.0 sayısı, test ortamına ve çaba ayarına bağlı olarak grafikler arasında farklılık gösterir; Anthropic, %66,4'lük oranını yüksek çabayla bildiriyor. Bu nedenle asla tek bir tabloda farklı kaynakları karıştırmayın.
Üçüncü taraf değerlendiriciler ne diyor?
Bağımsız liderlik tabloları farkı daraltıyor. Artificial Analysis, Argon'u 223 model arasında 8. sırada listeliyor, ancak bu liste her muhakeme ayarını ayrı ayrı sayıyor. Farklı modellere göre Argon (53), GPT-6 Astra ve Claude Fable 5.1 ile berabere kalırken, Claude Opus 5.5'in (maksimumda 58) ve Claude Sonnet 5.5'in (56) gerisinde kalıyor. AA ayrıca, AA-Omniscience'de Argon'un halüsinasyon oranını %15 olarak listelerken, Astra'nın maksimum ayarında %51 olarak belirtiyor.
Arena'da, Argon 1525 ile Metin kategorisinde birinci sırada yer alıyor, 4.942 oyda Ön Hazırlık olarak işaretlendi, Opus 5.5 ise dördüncü sırada. Vals AI, Vals Endeksi'nde 41 model arasında birinci sıraya yerleştiriyor, bu da onu zirveye çıkan ilk Gemini modeli yapıyor.
Google içindeki herkes ikna olmuş değil: Bloomberg, erişimi olan bazı çalışanların Argon'un belirli kodlama ve ön uç tasarım işlerinde kıyaslamalarına göre yetersiz kaldığını bildirdi, bu tanımlamayı Google yanlış olarak nitelendirdi.
Hangisine yönlendirmeli
2026'da tek bir en iyi öncü model yok. Göreve göre yönlendirme yapın ve Argon sütununu piyasaya sürüldüğü güne saklayın:
| Görev | Bugün yönlendir | Argon piyasaya çıktığında |
|---|---|---|
| Hukuk, finans ve ofis otomasyon ajanları | Opus 5.5 (%67,0 Vals Endeksi) | Argon'u test edin: dört bilgi işi satırının hepsinde lider |
| Terminal ağırlıklı kodlama ajanları | Opus 5.5 (%66,4 Terminal-bench 4.0) | Opus 5.5 hala lider |
| Ajan tabanlı yazılım mühendisliği | Astra (%65,5 FrontierSWE v2) veya Opus 5.5 | Argon DeepSWE'de lider ama FrontierSWE'nin gerisinde; ikisini de test edin |
| Bilgisayar kullanımı ve GUI ajanları | Astra (%72,6 OSWorld-2.0) | Astra OSWorld'de lider; Argon Agent's Last Exam'da lider |
| 256K+ belirteç istemleri üzerinde akıl yürütme | Opus 5.5 (ek ücret yok) veya Astra (272K üzeri ek ücretli) | Argon (%84,2 GraphWalks 256K'dan 1M'ye) |
| Video ve grafik anlama | Astra (%87,5 LVBench) | Argon (%91,7), kare sayısı uyarısıyla |
| Bilim ve ML mühendisliği | Astra (Terminal-Bench Bilim), Opus 5.5 (PostTrainBench) | Argon LABBench 2 ve RiemannBench'te lider; test edin |
| 128K belirteçten fazla tek yanıtlar | Batch'te Opus 5.5 (300K, beta) | Argon, Google'ın belirttiği 1M'ye kadar |
| Yüksek hacimli, maliyete duyarlı işler | Opus 5.5 (4$/20$) | Tanıtım sürdüğü sürece Argon 2$/10$ |
Eğer fiyat en yüksek puanlardan daha önemliyse, GPT-6 Sol vs Claude Opus 5.5 karşılaştırmamız, OpenAI'ın daha ucuz Sol serisini Opus'a karşı ele alıyor.
Üçünü de kendi komut istemlerinizde karşılaştırın
Satıcı tabloları, her modelin komut istemlerinizi nasıl işlediğini size söyleyemez. Apidog'daki küçük bir değerlendirme bunu yapabilir ve bugün oluşturabilirsiniz.
- Üç istekle bir proje oluşturun: GPT-6 Astra, Claude Opus 5.5 ve model alanı `{{GEMINI_MODEL}}` okuyan bir Gemini isteği, Google Argon'un kimliğini yayınlayana kadar `gemini-3.8-flash` olarak ayarlandı. GPT-6 Astra API kılavuzumuz ve Claude Opus 5.5 nedir, her satıcının istek biçimini kapsar.
- Her satıcının API anahtarını bir ortam değişkeni olarak saklayın ve istemi ortak bir değişkene koyun, böylece üç istek de aynı girişi alır.
- Onaylar ekleyin: durum 200, boş olmayan bir yanıt, bir tavanın altındaki çıktı belirteçleri ve her satıcının yayınlanmış oranlarında bütçenizin altında hesaplanmış bir maliyet.
- Üçünü tek bir test senaryosu olarak çalıştırın ve test raporundaki her isteğin sonuçlarını karşılaştırın.
Maliyet onayı basit aritmetiktir. 20.000 giriş ve 4.000 çıkış belirteci olan bir istek için Astra, 20.000 x 10$/1M + 4.000 x 50$/1M = 0.20$ + 0.20$ = 0.40$ maliyetlidir. Opus 5.5, 0.08$ + 0.08$ = 0.16$ maliyetlidir. Argon, tanıtım oranlarında 0.08$ ve standart oranlarda 0.16$ maliyetli olacaktır. Ancak belirteç başına fiyat, görev başına maliyet değildir: Artificial Analysis, Argon'u görev başına yaklaşık 62K çıktı belirteci olarak ölçerken, Astra'yı maksimum çabada yaklaşık 27K olarak ölçtü, bu nedenle kendi komut istemlerinizde çıktı belirteçlerini ölçün.
Argon piyasaya çıktığında, `GEMINI_MODEL`'i değiştirin, senaryoyu yeniden çalıştırın ve şimdi satın alabileceğiniz iki modele karşı aynı istem karşılaştırmasına sahip olun.
SSS
Gemini 4 Argon, GPT-6 Astra'dan daha mı iyi? Artificial Analysis'te 53'te berabere kalıyorlar. Google'ın tablosunda Argon çoğu satırda daha yüksek puan alsa da, Astra FrontierSWE v2, Terminal-Bench Science 0.1 ve OSWorld-2.0'ı kazanıyor ve Astra bugün arayabileceğiniz modeldir.
Gemini 4 Argon vs Claude Opus 5.5: hangisi daha iyi? Google'ın tablosu Argon'u çoğu satırda destekliyor; Opus 5.5 Terminal-bench 4.0 ve PostTrainBench'i kazanıyor ve Artificial Analysis'te 58'e 53 lider durumda. Standart oranlarda aynı maliyete sahipler.
Gemini 4 Argon, Claude Opus 5.5'ten daha mı ucuz? Tanıtım dönemi boyunca yarı fiyatına (2$/10$'a karşı 4$/20$). Ondan sonra liste fiyatları aynı ve Google tanıtım döneminin ne zaman biteceğini söylemedi.
Hangi modelin en büyük çıktı limiti var? Argon, belirtilen 1M belirteç ile, ancak Vals AI test ettiği yapılandırma için 262K listeliyor. Diğerleri senkron çıktıyı 128K ile sınırlıyor. 1M çıktı belirteçleri kılavuzumuz, bunun istemciniz için ne anlama geldiğini kapsar.
Gemini 4 Argon'u bugün kullanabilir miyim? Yalnızca Google'ın Fairwind Programı aracılığıyla, belirli onaylanmış siber savunma ortakları için. Ücretli API müşterileri ve Google AI Ultra aboneleri daha sonra geliyor, ancak bir tarih yok.
İş yüküne göre seçin, sonra test edin
Argon, bilgi işi, uzun bağlam ve çok modlu satırlarda en güçlü görünüyor; Astra, FrontierSWE, Terminal-Bench Science ve OSWorld'de; Opus 5.5, terminal işleri ve ML mühendisliğinde, Argon'un tanıtım sonrası fiyatıyla. Şimdi satın alabileceğiniz iki modeli temel alın, Gemini modelini bir değişkende tutun ve Argon açıldığında senaryonuzu yeniden çalıştırın. Tek bir projede üç istekli karşılaştırmayı kurmak için, Apidog'u indirin.
