Grok 4.7, çıktı tokenları açısından üç model arasında en ucuzu (GPT-6 Sol için $10 ve Claude Opus 5.5 için $20'ye karşılık milyon başına $6), ve Opus 5.5, bu satıcıların ikisinin aynı adı yayınladığı her kodlama karşılaştırmasında lider durumda. Üçüncü taraf bir birleşik endeks olan Artificial Analysis Intelligence Index'te sıralama şöyle: Opus 5.5 58, Sol 48 ve Grok 4.7 46. Hangisinin size daha az maliyetli olacağı önbelleğe almaya ve her modelin görev başına ne kadar token harcadığına bağlıdır; önbellek yoğun bir ajan iş yükünde Sol, Grok'u geride bırakır.
Üçü de yaklaşık 36 saat içinde piyasaya sürüldü. SpaceXAI, Grok 4.7'yi 21 Eylül 2026'da yayınladı ve Anthropic ile OpenAI, Opus 5.5 ve Sol'u 22 Eylül'de yayınladı. Bu zamanlama, herhangi bir karşılaştırmayı okumadan önce, bu yazı da dahil olmak üzere, bilmeniz gereken bir sorun yarattı. Aşağıda: özellik tablosu, çakışan karşılaştırma satırları, önbelleğe alma ile ve önbelleğe alma olmadan fiyat hesaplaması, yönlendirme tavsiyeleri ve üçünü de tek bir Apidog projesinde test etme yöntemi bulunmaktadır. Her model için ayrı ayrı: Grok 4.7 nedir, GPT-6 Sol nedir ve Claude Opus 5.5 nedir makalelerine bakın.
Kimse bu üçünü birbirine karşı karşılaştırmadı
Her lansman, yazıldığı zaman var olan modellerle karşılaştırılıyor:
- SpaceXAI'nin Grok 4.7 gönderisi, Grok 4.6, GPT-5.6 Sol ve Claude Fable 5.1 ile karşılaştırılıyor, ayrıca iki grafikte GPT-6 Astra da bulunuyor. İsme dikkat edin: GPT-5.6 Sol, bir önceki nesil olup o sayfada $4/$20 olarak listelenmiştir, ertesi gün piyasaya sürülen GPT-6 Sol değildir.
- OpenAI'nin Sol lansmanı, Opus 5.5'in saatler sonra yerini aldığı Claude Opus 5 ile karşılaştırılıyor.
- Anthropic'in Opus 5.5 lansmanı, rakip sütunları olmadan puanları yayınlamaktadır.
Yani hiçbir satıcı tablosunda üçü de yer almıyor. Yapabileceğiniz şey, aynı karşılaştırma adını paylaşan satırları yan yana getirmek, bunları bir sıralamadan ziyade bir yön olarak okumak ve üçüncü taraf bir endeksi dengeleyici olarak kullanmaktır. GPT-6 Sol ve Claude Opus 5.5 karşılaştırmamız bu ikili hakkında daha derinlemesine bilgi veriyor.
Özellikler tablosu
| Grok 4.7 | GPT-6 Sol | Claude Opus 5.5 | |
|---|---|---|---|
| API model kimliği | grok-4.7 |
gpt-6-sol |
claude-opus-5-5 |
| Yayın tarihi | 21 Eylül 2026 | 22 Eylül 2026 | 22 Eylül 2026 |
| 1M başına giriş / çıkış | $2 / $6 | $2 / $10 | $4 / $20 |
| 1M başına önbelleğe alınmış giriş okuma | $0.50 | $0.20 (%90 indirimli) | $0.20 |
| Bağlam penceresi | 500.000 | 872.000 | 1.000.000 |
| Maksimum çıktı | listelenmemiş | belirtilmemiş | 128.000 |
| AA Zeka Endeksi (üçüncü taraf) | 46 (211 üzerinden #21) | 48 | 58 (212 üzerinden #1) |
| AA çıktı hızı (üçüncü taraf) | xhigh'ta 82.6 token/s | max'ta 115.2 token/s, ilk tokene 102 s | kaynaklarımızda yok |
| Nereden çağrılır | xAI API, Cursor, GitHub Copilot, Grok Build, OpenRouter, Vercel | OpenAI API, ChatGPT Work, Codex | Claude Platformu, AWS, Google Cloud, Azure |
Çoğu iş yükünü iki satır belirler. Çıktı fiyatı: Grok 4.7'nin $6'sı Sol'un %40, Opus 5.5'in ise %70 altındadır ve bu durum muhakeme modelleri için önemlidir çünkü düşünme tokenları çıktı olarak faturalandırılır. Bağlam: Grok 4.7 en küçük pencereye sahiptir ve bir istem 200.000 tokene ulaştığında xAI tüm isteği çift oranla ($4 giriş, $12 çıktı) faturalandırır.
Çakışan karşılaştırmalar
Bu satırlar, satıcı tablolarında aynı karşılaştırma adını paylaşmaktadır. Her satıcı kendi modelini kendi test düzeneğinde kendi çaba ayarlarıyla çalıştırdığından, küçük farklar gürültüdür. Büyük farklar ise size hala bir şeyler söyler.
| Karşılaştırma (satıcı tarafından yürütülen) | Grok 4.7 | GPT-6 Sol | Claude Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | %37.6 (xhigh) | yayınlanmadı | %66.4 |
| CursorBench 4.0 | %46.3 (xhigh) | yayınlanmadı | %57.8 |
| DeepSWE v1.1 | %71.0 (high) | %68.8 (max) | yayınlanmadı |
| GDPval, Elo | 1.695 (xhigh) | yayınlanmadı | 1.846 (GDPval-AA v2.1) |
Nasıl okunur:
- Terminal işleri, Opus 5.5'i büyük farkla öne çıkarıyor. Terminal-Bench 4.0'daki 28.8 puanlık fark, yalnızca test düzeneği farklılıklarıyla açıklanamayacak kadar büyük. Grok 4.7'nin %37.6'sı, Grok 4.6'nın %20.3'ünden büyük bir sıçrama olmasına rağmen hala oldukça geride.
- CursorBench de aynı yöne işaret ediyor, 11.5 puanlık farkla.
- DeepSWE'de durum eşit. Yüksek çabadaki Grok 4.7 ve maksimumdaki Sol, farklı test düzeneklerinin ürettiği aralıkta, 2.2 puanlık bir farkla birbirine yakın.
- GDPval sürümleri farklılık gösterebilir. Grok'un tablosunda bir sürüm belirtilmediği için, 151 puanlık farkı bir ipucu olarak değerlendirin.
Grok 4.7, kendi tablosundaki iki değerlendirmede önde: Harvey's Legal Agent Benchmark'ta %19.6 (GPT-5.6 Sol %2.5, Fable 5.1 %6.7) ve elektrik mühendisliği değerlendirmesi olan EEBench'te %64.0 (Fable 5.1 %56.4; aynı grafikte GPT-6 Astra %69.3). Sol ve Opus 5.5'in ikisinde de yayınlanmış bir puanı bulunmadığından, bunları bu iki rakibe karşı kazanılmış zaferler olarak değil, hukuki ve mühendislik bilgi işleri için sinyaller olarak okuyun.
Bir bağımsız test düzeneği, üç modelden ikisini aynı şekilde çalıştırıyor. SWE-Together'da, tek bir ajan test düzeneği aracılığıyla 109 gerçek depo görevi çalıştırıldığında, Opus 5.5 %68.8 pass@1 ve Grok 4.7 %64.7 puan alıyor; bu da Terminal-Bench'teki 29 puanlık fark yerine yaklaşık 4 puanlık bir fark demek. GPT-6 Sol henüz orada listelenmemiş. Grok 4.7 ayrıca o tabloda görev başına $7.81 harcadı, bu yüzden token fiyatı görev başına onu ucuz yapmadı.
Üçüncü taraf endeks, genel sıralamayla hemfikir: Opus 5.5 58, Sol 48, Grok 4.7 46. Grok'un tarafındaki her satır ve uyarı için, aynı zamanda Grok 4.7'nin sandbox'larını aşarak yukarı akış düzeltmelerini aldığını belirten bir karşılaştırma bakımcısının raporunu da içeren Grok 4.7 karşılaştırma analizimize bakın.
Her birinin gerçek bir iş yükünde maliyeti ne kadar?
Token başına fiyatlar hikayenin sadece bir kısmını anlatır. İşte günde 1.000 çalıştırma ile iki iş yükü şekli için yayınlanan oranlar üzerinden bir hesaplama. Önbellek yazmaları hariçtir; Opus 5.5 bunlar için milyon başına $5 ücret alır.
Ajan döngüsü, önbellek dostu: Çalıştırma başına 50.000 giriş tokenı, bunların 45.000'i sabit bir ön ek (sistem istemi, araç şemaları, belgeler) ve 3.000 çıktı tokenı.
| Günlük maliyet | Grok 4.7 | GPT-6 Sol | Claude Opus 5.5 |
|---|---|---|---|
| Önbellek isabeti yok | $118.00 | $130.00 | $260.00 |
| Ön ek önbelleğe alınmış | $50.50 | $49.00 | $89.00 |
Önbelleğe alma olmadan Grok 4.7 en ucuzudur. Ön ek önbelleğe alındığında Sol öne geçer, çünkü önbelleğe alınmış okumaları Grok'un milyon başına $0.50'sine karşı milyon başına $0.20'ye mal olur. İstemleriniz ne kadar çok tekrarlanırsa, Grok'un çıktı indirimi o kadar az yardımcı olur.
Muhakeme ağırlıklı görev: Çalıştırma başına 10.000 giriş tokenı ve 20.000 çıktı tokenı.
| Günlük maliyet | Grok 4.7 | GPT-6 Sol | Claude Opus 5.5 |
|---|---|---|---|
| Önbelleksiz | $140 | $220 | $440 |
Burada çıktı fiyatı belirleyici oluyor: Grok 4.7, Sol'un yaklaşık %64'ü ve Opus 5.5'in %32'si kadar maliyetlidir.
Her iki tablo da her modelin aynı sayıda token harcadığını varsayar, oysa harcamazlar. SpaceXAI'nin kendi CursorBench verileri, Grok 4.7'nin xhigh'ta görev başına ortalama 70.141 çıktı tokenı ve low'da 15.677 token harcadığını göstermektedir. İki kat tokena ihtiyaç duyan bir model, fiyat avantajını kaybeder. İstemlerinizde tamamlanan görev başına maliyet bunu belirler; fiyat savaşı analizimiz, satıcıların bu metriği neden yayınlamaya başladığını açıklamaktadır.
Hangisine yönlendirilmeli
İş yükünden başlayın, sonra test edin:
- Grok 4.7, çıktı ağırlıklı ajan döngülerine, bütçeye duyarlı muhakemeye, hukuki ve mühendislik bilgi işlerine ve zaten Cursor, GitHub Copilot veya Grok Build kullanan ekiplere uyar; bu ortamlarda yalnızca bir model seçici değişikliğiyle kullanılabilir. İstemleri 200.000 token altında tutun.
- Claude Opus 5.5, en zorlu kodlama ve terminal görevlerine uyar; bu alanlarda liderliği en geniştir, ayrıca 1M pencereli veya 128.000 tokenlık çıktılara ihtiyaç duyan her şey için uygundur. İlk günden itibaren AWS, Google Cloud ve Azure'da da çalıştı, bu da tedarikin önemli olduğu durumlarda yardımcı olur.
- GPT-6 Sol, önbellek ağırlıklı ajanlar ve otomasyon için uygundur, ayrıca 200.000 ile 872.000 token arasındaki istemler için de. Artificial Analysis'ın maksimum çabayla ölçtüğü ilk tokena ulaşma süresi olan 102 saniyeyi bütçenizde bulundurun; Sol gecikme kılavuzumuz zaman aşımlarını kapsar.
- GPT-6 Luna, $0.10/$0.50 fiyatıyla, yüksek hacimli çıkarım ve sınıflandırma için konuşulması gereken bir modeldir, bu alanlarda yukarıdaki üç modelden hiçbiri maliyet etkin değildir.
Birçok ekip, bir yönlendiricinin arkasında bu modellerden ikisini çalıştıracaktır: ucuz bir varsayılan model ve başarısız olan görevler için pahalı bir yükseltme yolu.
Üçünü de tek bir Apidog projesinde test edin
Asıl önemli olan karşılaştırma, test düzeneğinizdeki istemlerinizdir. Apidog bunu bir hafta sonu projesi yerine kaydedilmiş bir teste dönüştürür:
- Üç ortam oluşturun, her sağlayıcı için bir tane, her biri
base_url, gizli bir API anahtarı vemodeliçersin. Grok 4.7 ve GPT-6 Sol'un her ikisi de Responses API'yi kullanır (birinputalanı ilePOST {{base_url}}/responses), bu nedenle tek bir istek tanımı ikisini de kapsar. Opus 5.5, Anthropic'in Messages API'sini kullanır (messages, gerekli birmax_tokensvex-api-keyileanthropic-versionbaşlıkları ilePOST /v1/messages), bu yüzden ona kendi isteğini verin. - Her istekte, kaymasını önlemek için paylaşılan bir değişkenden çekilen aynı istem metnini kullanın.
- Durum kodu 200, boş olmayan bir yanıt ve
usage.input_tokensileusage.output_tokensvarlığı için onaylar ekleyin. - Bunları tek bir test senaryosu olarak çalıştırın ve yanıt süresini, token sayılarını ve çıktıları yan yana karşılaştırın. Görevinizdeki çalıştırma başına maliyeti elde etmek için tokenları yukarıdaki fiyat satırlarıyla çarpın.
Benchmark tablosundaki değil, sevk edeceğiniz çaba seviyesinde çalıştırın. Oluşturmak için Apidog'u indirin.
Sıkça Sorulan Sorular
Grok 4.7, GPT-6'dan daha mı iyi? Mevcut verilere göre değil. Artificial Analysis endeksi GPT-6 Sol'u 48, Grok 4.7'yi ise 46'ya yerleştiriyor ve OpenAI, GPT-6 Astra'yı en iyi modeli olarak adlandırıyor. Grok 4.7 çıktı konusunda daha ucuz ve kendi hukuki ve mühendislik değerlendirmelerinde lider durumda.
Grok 4.7, Claude Opus 5.5'ten daha mı iyi? Opus 5.5, Terminal-Bench 4.0'da (%66.4'e karşı %37.6) ve CursorBench 4.0'da (%57.8'e karşı %46.3) lider konumda ve Artificial Analysis endeksinde birinci sırada yer alıyor. Grok 4.7, girişte yarı yarıya, çıktıdaysa üçte birinden daha az maliyetlidir.
Hangisi en ucuz? Token başına, çıktı için Grok 4.7, giriş için Sol ile aynı seviyede. Yoğun istem önbelleğe alma durumunda, Sol öne geçebilir çünkü önbelleğe alınmış okumaları Grok'un milyon başına $0.50'sine karşılık milyon başına $0.20'ye mal olur.
Üçünü de ücretsiz deneyebilir miyim? Her birinin sınırlı ücretsiz yolları vardır. Grok 4.7'yi ücretsiz nasıl kullanacağınızı, GPT-6 Sol'u ücretsiz nasıl kullanacağınızı ve Claude Opus 5.5'i ücretsiz nasıl kullanacağınızı görün.
Grok 4.7'yi koddan nasıl çağırırım? POST https://api.x.ai/v1/responses isteğini "model": "grok-4.7" ile birlikte kullanın. Grok 4.7 API kılavuzu curl ve SDK örnekleri içermektedir.
Kendi rakamlarınızla karar verin
İş yükünüzün işaret ettiği iki modeli seçin, her ikisine de Apidog'da aynı istemi kaydedin ve üretim çaba seviyenizde çalıştırın. Tamamlanan görev başına maliyeti ve gecikmeyi karşılaştırın, ardından yönlendirin. Bir sonraki model geldiğinde, bir ortam ekleyin ve tekrar çalıştırın.
