Grok 4.7, GPT-6 Sol, Claude Opus 5.5 Karşılaştırması: Fiyat, Performans ve Hangisini Seçmeli

Grok 4.7, GPT-6 Sol ve Claude Opus 5.5: fiyatlar, bağlam, örtüşen kıyaslamalar, gerçek iş yüklerinde önbellek matematiği ve hangisine yönlendirileceği.

Ashley Innocent

Ashley Innocent

29 September 2026

Grok 4.7, GPT-6 Sol, Claude Opus 5.5 Karşılaştırması: Fiyat, Performans ve Hangisini Seçmeli

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

Grok 4.7, çıktı tokenları açısından üç model arasında en ucuzu (GPT-6 Sol için $10 ve Claude Opus 5.5 için $20'ye karşılık milyon başına $6), ve Opus 5.5, bu satıcıların ikisinin aynı adı yayınladığı her kodlama karşılaştırmasında lider durumda. Üçüncü taraf bir birleşik endeks olan Artificial Analysis Intelligence Index'te sıralama şöyle: Opus 5.5 58, Sol 48 ve Grok 4.7 46. Hangisinin size daha az maliyetli olacağı önbelleğe almaya ve her modelin görev başına ne kadar token harcadığına bağlıdır; önbellek yoğun bir ajan iş yükünde Sol, Grok'u geride bırakır.

button

Üçü de yaklaşık 36 saat içinde piyasaya sürüldü. SpaceXAI, Grok 4.7'yi 21 Eylül 2026'da yayınladı ve Anthropic ile OpenAI, Opus 5.5 ve Sol'u 22 Eylül'de yayınladı. Bu zamanlama, herhangi bir karşılaştırmayı okumadan önce, bu yazı da dahil olmak üzere, bilmeniz gereken bir sorun yarattı. Aşağıda: özellik tablosu, çakışan karşılaştırma satırları, önbelleğe alma ile ve önbelleğe alma olmadan fiyat hesaplaması, yönlendirme tavsiyeleri ve üçünü de tek bir Apidog projesinde test etme yöntemi bulunmaktadır. Her model için ayrı ayrı: Grok 4.7 nedir, GPT-6 Sol nedir ve Claude Opus 5.5 nedir makalelerine bakın.

Kimse bu üçünü birbirine karşı karşılaştırmadı

Her lansman, yazıldığı zaman var olan modellerle karşılaştırılıyor:

Yani hiçbir satıcı tablosunda üçü de yer almıyor. Yapabileceğiniz şey, aynı karşılaştırma adını paylaşan satırları yan yana getirmek, bunları bir sıralamadan ziyade bir yön olarak okumak ve üçüncü taraf bir endeksi dengeleyici olarak kullanmaktır. GPT-6 Sol ve Claude Opus 5.5 karşılaştırmamız bu ikili hakkında daha derinlemesine bilgi veriyor.

Özellikler tablosu

Grok 4.7 GPT-6 Sol Claude Opus 5.5
API model kimliği grok-4.7 gpt-6-sol claude-opus-5-5
Yayın tarihi 21 Eylül 2026 22 Eylül 2026 22 Eylül 2026
1M başına giriş / çıkış $2 / $6 $2 / $10 $4 / $20
1M başına önbelleğe alınmış giriş okuma $0.50 $0.20 (%90 indirimli) $0.20
Bağlam penceresi 500.000 872.000 1.000.000
Maksimum çıktı listelenmemiş belirtilmemiş 128.000
AA Zeka Endeksi (üçüncü taraf) 46 (211 üzerinden #21) 48 58 (212 üzerinden #1)
AA çıktı hızı (üçüncü taraf) xhigh'ta 82.6 token/s max'ta 115.2 token/s, ilk tokene 102 s kaynaklarımızda yok
Nereden çağrılır xAI API, Cursor, GitHub Copilot, Grok Build, OpenRouter, Vercel OpenAI API, ChatGPT Work, Codex Claude Platformu, AWS, Google Cloud, Azure

Çoğu iş yükünü iki satır belirler. Çıktı fiyatı: Grok 4.7'nin $6'sı Sol'un %40, Opus 5.5'in ise %70 altındadır ve bu durum muhakeme modelleri için önemlidir çünkü düşünme tokenları çıktı olarak faturalandırılır. Bağlam: Grok 4.7 en küçük pencereye sahiptir ve bir istem 200.000 tokene ulaştığında xAI tüm isteği çift oranla ($4 giriş, $12 çıktı) faturalandırır.

Çakışan karşılaştırmalar

Bu satırlar, satıcı tablolarında aynı karşılaştırma adını paylaşmaktadır. Her satıcı kendi modelini kendi test düzeneğinde kendi çaba ayarlarıyla çalıştırdığından, küçük farklar gürültüdür. Büyük farklar ise size hala bir şeyler söyler.

Karşılaştırma (satıcı tarafından yürütülen) Grok 4.7 GPT-6 Sol Claude Opus 5.5
Terminal-Bench 4.0 %37.6 (xhigh) yayınlanmadı %66.4
CursorBench 4.0 %46.3 (xhigh) yayınlanmadı %57.8
DeepSWE v1.1 %71.0 (high) %68.8 (max) yayınlanmadı
GDPval, Elo 1.695 (xhigh) yayınlanmadı 1.846 (GDPval-AA v2.1)

Nasıl okunur:

Grok 4.7, kendi tablosundaki iki değerlendirmede önde: Harvey's Legal Agent Benchmark'ta %19.6 (GPT-5.6 Sol %2.5, Fable 5.1 %6.7) ve elektrik mühendisliği değerlendirmesi olan EEBench'te %64.0 (Fable 5.1 %56.4; aynı grafikte GPT-6 Astra %69.3). Sol ve Opus 5.5'in ikisinde de yayınlanmış bir puanı bulunmadığından, bunları bu iki rakibe karşı kazanılmış zaferler olarak değil, hukuki ve mühendislik bilgi işleri için sinyaller olarak okuyun.

Bir bağımsız test düzeneği, üç modelden ikisini aynı şekilde çalıştırıyor. SWE-Together'da, tek bir ajan test düzeneği aracılığıyla 109 gerçek depo görevi çalıştırıldığında, Opus 5.5 %68.8 pass@1 ve Grok 4.7 %64.7 puan alıyor; bu da Terminal-Bench'teki 29 puanlık fark yerine yaklaşık 4 puanlık bir fark demek. GPT-6 Sol henüz orada listelenmemiş. Grok 4.7 ayrıca o tabloda görev başına $7.81 harcadı, bu yüzden token fiyatı görev başına onu ucuz yapmadı.

Üçüncü taraf endeks, genel sıralamayla hemfikir: Opus 5.5 58, Sol 48, Grok 4.7 46. Grok'un tarafındaki her satır ve uyarı için, aynı zamanda Grok 4.7'nin sandbox'larını aşarak yukarı akış düzeltmelerini aldığını belirten bir karşılaştırma bakımcısının raporunu da içeren Grok 4.7 karşılaştırma analizimize bakın.

Her birinin gerçek bir iş yükünde maliyeti ne kadar?

Token başına fiyatlar hikayenin sadece bir kısmını anlatır. İşte günde 1.000 çalıştırma ile iki iş yükü şekli için yayınlanan oranlar üzerinden bir hesaplama. Önbellek yazmaları hariçtir; Opus 5.5 bunlar için milyon başına $5 ücret alır.

Ajan döngüsü, önbellek dostu: Çalıştırma başına 50.000 giriş tokenı, bunların 45.000'i sabit bir ön ek (sistem istemi, araç şemaları, belgeler) ve 3.000 çıktı tokenı.

Günlük maliyet Grok 4.7 GPT-6 Sol Claude Opus 5.5
Önbellek isabeti yok $118.00 $130.00 $260.00
Ön ek önbelleğe alınmış $50.50 $49.00 $89.00

Önbelleğe alma olmadan Grok 4.7 en ucuzudur. Ön ek önbelleğe alındığında Sol öne geçer, çünkü önbelleğe alınmış okumaları Grok'un milyon başına $0.50'sine karşı milyon başına $0.20'ye mal olur. İstemleriniz ne kadar çok tekrarlanırsa, Grok'un çıktı indirimi o kadar az yardımcı olur.

Muhakeme ağırlıklı görev: Çalıştırma başına 10.000 giriş tokenı ve 20.000 çıktı tokenı.

Günlük maliyet Grok 4.7 GPT-6 Sol Claude Opus 5.5
Önbelleksiz $140 $220 $440

Burada çıktı fiyatı belirleyici oluyor: Grok 4.7, Sol'un yaklaşık %64'ü ve Opus 5.5'in %32'si kadar maliyetlidir.

Her iki tablo da her modelin aynı sayıda token harcadığını varsayar, oysa harcamazlar. SpaceXAI'nin kendi CursorBench verileri, Grok 4.7'nin xhigh'ta görev başına ortalama 70.141 çıktı tokenı ve low'da 15.677 token harcadığını göstermektedir. İki kat tokena ihtiyaç duyan bir model, fiyat avantajını kaybeder. İstemlerinizde tamamlanan görev başına maliyet bunu belirler; fiyat savaşı analizimiz, satıcıların bu metriği neden yayınlamaya başladığını açıklamaktadır.

Hangisine yönlendirilmeli

İş yükünden başlayın, sonra test edin:

Birçok ekip, bir yönlendiricinin arkasında bu modellerden ikisini çalıştıracaktır: ucuz bir varsayılan model ve başarısız olan görevler için pahalı bir yükseltme yolu.

Üçünü de tek bir Apidog projesinde test edin

Asıl önemli olan karşılaştırma, test düzeneğinizdeki istemlerinizdir. Apidog bunu bir hafta sonu projesi yerine kaydedilmiş bir teste dönüştürür:

  1. Üç ortam oluşturun, her sağlayıcı için bir tane, her biri base_url, gizli bir API anahtarı ve model içersin. Grok 4.7 ve GPT-6 Sol'un her ikisi de Responses API'yi kullanır (bir input alanı ile POST {{base_url}}/responses), bu nedenle tek bir istek tanımı ikisini de kapsar. Opus 5.5, Anthropic'in Messages API'sini kullanır (messages, gerekli bir max_tokens ve x-api-key ile anthropic-version başlıkları ile POST /v1/messages), bu yüzden ona kendi isteğini verin.
  2. Her istekte, kaymasını önlemek için paylaşılan bir değişkenden çekilen aynı istem metnini kullanın.
  3. Durum kodu 200, boş olmayan bir yanıt ve usage.input_tokens ile usage.output_tokens varlığı için onaylar ekleyin.
  4. Bunları tek bir test senaryosu olarak çalıştırın ve yanıt süresini, token sayılarını ve çıktıları yan yana karşılaştırın. Görevinizdeki çalıştırma başına maliyeti elde etmek için tokenları yukarıdaki fiyat satırlarıyla çarpın.

Benchmark tablosundaki değil, sevk edeceğiniz çaba seviyesinde çalıştırın. Oluşturmak için Apidog'u indirin.

Sıkça Sorulan Sorular

Grok 4.7, GPT-6'dan daha mı iyi? Mevcut verilere göre değil. Artificial Analysis endeksi GPT-6 Sol'u 48, Grok 4.7'yi ise 46'ya yerleştiriyor ve OpenAI, GPT-6 Astra'yı en iyi modeli olarak adlandırıyor. Grok 4.7 çıktı konusunda daha ucuz ve kendi hukuki ve mühendislik değerlendirmelerinde lider durumda.

Grok 4.7, Claude Opus 5.5'ten daha mı iyi? Opus 5.5, Terminal-Bench 4.0'da (%66.4'e karşı %37.6) ve CursorBench 4.0'da (%57.8'e karşı %46.3) lider konumda ve Artificial Analysis endeksinde birinci sırada yer alıyor. Grok 4.7, girişte yarı yarıya, çıktıdaysa üçte birinden daha az maliyetlidir.

Hangisi en ucuz? Token başına, çıktı için Grok 4.7, giriş için Sol ile aynı seviyede. Yoğun istem önbelleğe alma durumunda, Sol öne geçebilir çünkü önbelleğe alınmış okumaları Grok'un milyon başına $0.50'sine karşılık milyon başına $0.20'ye mal olur.

Üçünü de ücretsiz deneyebilir miyim? Her birinin sınırlı ücretsiz yolları vardır. Grok 4.7'yi ücretsiz nasıl kullanacağınızı, GPT-6 Sol'u ücretsiz nasıl kullanacağınızı ve Claude Opus 5.5'i ücretsiz nasıl kullanacağınızı görün.

Grok 4.7'yi koddan nasıl çağırırım? POST https://api.x.ai/v1/responses isteğini "model": "grok-4.7" ile birlikte kullanın. Grok 4.7 API kılavuzu curl ve SDK örnekleri içermektedir.

Kendi rakamlarınızla karar verin

İş yükünüzün işaret ettiği iki modeli seçin, her ikisine de Apidog'da aynı istemi kaydedin ve üretim çaba seviyenizde çalıştırın. Tamamlanan görev başına maliyeti ve gecikmeyi karşılaştırın, ardından yönlendirin. Bir sonraki model geldiğinde, bir ortam ekleyin ve tekrar çalıştırın.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin