GPT-6.1 Sol API'yi çağırmak için, `https://api.openai.com/v1/responses` adresine `"model": "gpt-6.1-sol"` ile bir POST isteği ve anahtarınızı bir Bearer token olarak gönderin. GPT-6 Sol ile aynı şekilde milyon token başına 2 dolar giriş ve 10 dolar çıkış fiyatına sahiptir ve önbelleğe alınmış giriş fiyatı 0.20 dolardan 0.10 dolara düşer. `gpt-6-sol`'dan geçiş çoğunlukla bir dize değişimidir. Önemli değişiklik çaba seviyesidir: GPT-6.1 Sol, `none` veya `minimal` kabul etmez, bu nedenle bu istekler, `none`'a dayanan tüm kodlarla birlikte `low` seviyesine taşınır.
OpenAI, GPT-6.1 Sol'u 29 Eylül 2026'daki DevDay etkinliğinde duyurdu. DevDay 2026 özeti diğer lansmanları, GPT-6.1 Sol nedir ise performans testlerini derinlemesine ele almaktadır. Bu kılavuz, ilk isteğinizi, hangi çaba seviyesinde başlayacağınızı, her geçiş değişikliğini, Batch, Flex ve Fast katmanlarını ve üretim trafiğini değiştirmeden önce Apidog'da her iki model ID'sinin yan yana bir regresyon testini kapsar.
GPT-6 Sol vs GPT-6.1 Sol: API'de neler değişiyor?
Spesifikasyonun çoğu aynıdır. İşte GPT-6.1 Sol model sayfası, GPT-6 Sol model sayfası ve OpenAI'ın GPT-6 geçiş kılavuzundan tam farklar:
gpt-6-sol |
gpt-6.1-sol |
Yapılacaklar | |
|---|---|---|---|
| 1M başına Giriş / çıkış (Standart) | $2 / $10 | $2 / $10 | Hiçbir şey |
| 1M başına önbelleğe alınmış giriş | $0.20 | $0.10 | Önbellek hesaplamanızı yeniden yapın |
| 1M başına önbellek yazma | $2.50 | $2.50 | Hiçbir şey |
| Bağlam penceresi / maksimum giriş / maksimum çıkış | 1,050,000 / 922,000 / 128,000 | 1,050,000 / 922,000 / 128,000 | Hiçbir şey |
| Bilgi kesme tarihi | 20 Nisan 2026 | 30 Nisan 2026 | Tarihe duyarlı değerlendirmeleri yeniden kontrol edin |
reasoning.effort |
none, low, medium (varsayılan), high, xhigh, max |
low, medium (varsayılan), high, xhigh, max |
none'ı low'a taşıyın ve yeniden değerlendirin |
| Sohbet Tamamlamalarında fonksiyon çağırma | Yalnızca reasoning_effort: "none" ile |
Desteklenmiyor | Araç çağrılarını Yanıtlara taşıyın |
| Uç Noktalar | Sohbet Tamamlamaları, Yanıtlar, Toplu İş | Aynı | Hiçbir şey |
| Oran sınırları | Katman 1: 500 RPM / 500K TPM; Katman 5: 15,000 RPM / 40M TPM | Aynı | Hiçbir şey |
GPT-6 Sol sayfası artık okuyucuları "daha yeni Sol modeli" olarak GPT-6.1 Sol'a yönlendiriyor.
İlk GPT-6.1 Sol isteğinizi gönderin
Anahtarınızı `OPENAI_API_KEY` olarak dışa aktarın, ardından Yanıtlar API'sini çağırın:
curl https://api.openai.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{
"model": "gpt-6.1-sol",
"reasoning": {"effort": "medium"},
"input": "List three ways a webhook retry policy can create duplicate orders. One line each."
}'
Python SDK'sı aynı ortam değişkenini okur:
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6.1-sol",
reasoning={"effort": "medium"},
input="List three ways a webhook retry policy can create duplicate orders. One line each.",
)
print(response.output_text)
print(response.usage)
Yanıtın dört önemli kısmı vardır:
- `status` başarı durumunda `completed` olur. Modelin çıktı bütçesi tükenirse, bazen görünür metin olmadan `incomplete_details.reason`'ı `max_output_tokens` olarak ayarlanmış `incomplete` yanıtını alırsınız. Muhakeme kılavuzu, deneme yaparken muhakeme ve çıktı için en az 25.000 token ayırmayı önerir.
- `output` bir dizidir. Cevap, `type: "message"` olan öğedir ve içeriği `output_text`'i barındırır. Dizine göre değil, türe göre okuyun.
- `usage.output_tokens` çıktı oranında faturalandırılan muhakeme tokenlarını içerir. `usage.output_tokens_details.reasoning_tokens` kaç tane olduğunu gösterir.
- `usage.input_tokens_details`, `cached_tokens` ve `cache_write_tokens` raporlar. Daha ucuz önbellek burada devreye girer.
Araç içeren her şey için Yanıtlar API'sini kullanın; GPT-6.1 Sol, Sohbet Tamamlamalarını yalnızca araç içermeyen istekler için destekler. Yanıtlar API kılavuzu, istek şeklini daha derinlemesine ele alır.
Bir muhakeme çaba seviyesi seçin
Çaba, ana maliyet ve kalite ayarınızdır ve ihmal ettiğinizde `medium` varsayılandır. OpenAI'ın model seçim kılavuzu, `medium`'u "karmaşık teknik işler ve revize etmeyi beklediğiniz koordineli çıktılar" ile, `xhigh`'ı ise cilalı çıktılar ve çelişkili kanıtlardan oluşturulmuş kararlar ile eşleştirir. OpenAI'ın lansman yazısı, ayarlara göre sonuçlar ekler. Bu performans testleri OpenAI tarafından raporlanmıştır ve tablo, OpenAI'ın metninde belirttiği farkları aktarır:
| Çaba | Buradan başlayın (için) | OpenAI'ın GPT-6.1 Sol için raporladıkları |
|---|---|---|
low |
Sohbet, çıkarım, sınıflandırma, none ile çalıştırdığınız her şey |
Kullanıcı tarafından işaretlenmiş konuşmalarda, gerçeğe dayalı hatası olan yanıtlar %11.4'ten (GPT-6 Sol) %7.7'ye düşer |
medium (varsayılan) |
Aracılı otomasyonlar ve araç çağırma iş akışları | AutomationBench 1.0.6: Claude Opus 5.5'e göre yaklaşık üçte bir maliyetle +2.2 pp; aynı ayarda GPT-6 Sol'a göre +4.8 pp |
high |
Zor hata ayıklama ve derinlemesine planlama | Ayara özgü iddia yok |
xhigh |
Cilalı çıktılar ve uzun asenkron çalıştırmalar | Ayara özgü iddia yok |
max |
Bilgisayar kullanımı ve zor bilim görevleri | OSWorld 2.0: GPT-6 Sol'da max ayarında yarıdan daha az maliyetle +7 pp. Terminal-Bench Science 0.1: görev başına 5.47 dolar, Opus 5.5 için 23.21 dolar ve GPT-6 Astra için 23.80 dolar karşılığında |
İki uyarı. Gerçeklik seti, normal trafik değil, daha önce hatalı olarak işaretlenmiş konuşmalardır. Ve Terminal-Bench Science'da GPT-6 Astra hala en yüksek puanı (%68.1) alıyor, bu nedenle OpenAI, en zor bilimsel işler için Astra'yı önermektedir.
`none` kullanan gecikmeye duyarlı çağrılar için `low` ile başlayın ve ölçüm yapın. Muhakeme kılavuzu, `low`'u "orta düzeyde bir gecikme artışı ile" verimli muhakeme olarak tanımlar. Konuşma sırasında çaba seviyesini istem önbelleğini bozmadan değiştirmek için, istek seviyesindeki `reasoning.effort`'ı değiştirmek yerine bir `configuration_update` giriş öğesi ekleyin.
gpt-6-sol'dan geçiş: dört kod değişikliği
- Model ID'sini değiştirin. `gpt-6-sol`'u `gpt-6.1-sol` ile değiştirin ve geri alma tek bir düzenleme olacak şekilde bunu yapılandırma veya bir ortam değişkeninde tutun.
- `none` ve `minimal`'ı yeniden eşleyin. OpenAI'ın rehberliği: `none` yerine `low` kullanın ve `minimal`'ı `low`'da başlatın ve temsili görevlerde karşılaştırın. `none`'dan yoksun olan GPT-6 Astra'da, onu göndermek HTTP 400 döndürür, bu nedenle trafiği taşımadan önce bunu düzeltin.
- Örnekleme parametrelerini kaldırın. Çaba `none` olmadığında, `temperature`, `top_p` ve `top_logprobs`'u (ve Sohbet Tamamlamalarında `logprobs`'u) kaldırın. GPT-6 Sol'da `temperature`'ı `none` ile eşleştiren kod buna ihtiyaç duyar.
- Sohbet Tamamlamaları araç çağrılarını Yanıtlara taşıyın. GPT-6 Sol, Sohbet Tamamlamalarında fonksiyon çağırmayı yalnızca `reasoning_effort: "none"` ile izin veriyordu. Bu kombinasyonun 6.1 Sol'da bir karşılığı yoktur.
Ardından güncelliğe bağlı her şeyi yeniden çalıştırın: kesme tarihi 20 Nisan'dan 30 Nisan 2026'ya taşınıyor. Astra'dan Sol'a geldiyseniz, Astra'dan Sol'a geçiş kılavuzu bu önceki adımı ele alır.
Batch, Flex, Fast ve önbelleğe alınmış giriş fiyatlandırması
Her katman GPT-6 Sol'un şeklini korur, önbelleğe alınmış giriş sütunu yarıya iner. 1M token başına fiyatlar API fiyatlandırma sayfasından alınmıştır. Model sayfası, 272K giriş tokenını aşan bir istemin tüm istek için 2 kat giriş ve önbellek oranları ve 1.5 kat çıktı olarak faturalandırıldığını ekler; bu, GPT-6 Sol'un kullandığı aynı kuraldır:
| Katman | Giriş | Önbelleğe alınmış giriş | Önbellek yazmaları | Çıkış |
|---|---|---|---|---|
| Standart | $2.00 | $0.10 | $2.50 | $10.00 |
| Toplu | $1.00 | $0.05 | $1.25 | $5.00 |
| Esnek | $1.00 | $0.05 | $1.25 | $5.00 |
| Hızlı | $4.00 | $0.20 | $5.00 | $20.00 |
| Standart, 272K giriş tokenını aşan istemler | $4.00 | $0.20 | $5.00 | $15.00 |
Flex, istek başına `service_tier: "flex"`'tir. Fast, `"priority"`'nin bir takma ad olarak kabul edildiği `service_tier: "fast"`'tir. Hızlı mod, AB veri yerleşimi ile kullanılamaz. GPT-6.1 Sol için Ultrafast "yakında geliyor" ve bugün geniş ölçüde yalnızca GPT-6 Astra için mevcuttur; bkz. OpenAI Ultrafast modu. Gece çalışan işler için OpenAI Batch API kılavuzu toplu bir çalıştırmayı anlatır.
Önbellek, yükseltmenin para tasarrufu sağladığı yerdir. İstem önbellekleme kılavuzuna göre, okumalar 6.1 Sol'da giriş oranının 0.05 katına mal olurken, GPT-6 Sol'da 0.1 katına mal olur ve yazmalar her ikisinde de 1.25 katına mal olur. 1.000 istekte yeniden kullanılan 50.000 tokenlık bir sistem istemi ele alalım. Bir yazma işlemi her iki modelde de 0.125 dolara mal olur; 999 okuma işlemi GPT-6 Sol'da 9.99 dolara ve GPT-6.1 Sol'da 5.00 dolara mal olur. Minimum önbelleğe alınabilir önek 1.024 görünür tokendır ve önbelleğe alınmış bir önek, son yazma veya yeniden kullanımdan sonra en az 30 dakika boyunca uygun kalır. Kesme noktası stratejisi için GPT-6 istem önbellekleme'ye bakın.
Apidog'da değişimi test edin
Yalnızca liste fiyatlarına dayanarak üretimi değiştirmeyin. Aynı kaydedilmiş isteği her iki ID'ye gönderin ve geri gelenleri karşılaştırın. Apidog'da:
- `OPENAI_API_KEY` (gizli olarak saklanan), `MODEL_ID`'si `gpt-6-sol` olarak ayarlanmış ve `EFFORT`'u `medium` olarak ayarlanmış bir ortam oluşturun.
- `Authorization: Bearer {{OPENAI_API_KEY}}` başlığı ve bu gövde ile `POST https://api.openai.com/v1/responses` isteğini oluşturun, ardından kaydedin:
{
"model": "{{MODEL_ID}}",
"reasoning": {"effort": "{{EFFORT}}"},
"max_output_tokens": 25000,
"input": "Return a JSON object with keys risk and fix for this policy: retry any 5xx three times with no idempotency key."
}
- Onaylar ekleyin: HTTP 200, `$.status` `completed` değerine eşit, `$.output[*].type` `message` içeriyor, `$.usage.output_tokens` 0'dan büyük ve `$.usage.output_tokens_details.reasoning_tokens` mevcut. Ardından, kodunuzun bağımlı olduğu çıktı şeklini, örneğin ayrıştırdığınız anahtarlara sahip geçerli bir JSON'u kontrol edin.
- OpenAI'ın istem önbellekleme kılavuzundaki giriş ayrımını kullanarak `usage` değerini dolara dönüştüren bir işlem sonrası betik ekleyin:
const u = pm.response.json().usage;
const d = u.input_tokens_details || {};
const cached = d.cached_tokens || 0;
const writes = d.cache_write_tokens || 0;
const model = pm.environment.get("MODEL_ID");
const cachedRate = model === "gpt-6.1-sol" ? 0.10 : 0.20;
const cost = ((u.input_tokens - cached - writes) * 2 + cached * cachedRate
+ writes * 2.5 + u.output_tokens * 10) / 1e6;
console.log(model, "cost per call $", cost.toFixed(5));
- Gönderin, `MODEL_ID`'yi `gpt-6.1-sol` olarak ayarlayın ve tekrar gönderin. `reasoning_tokens`, `output_tokens`, cevabı ve kaydedilen maliyeti karşılaştırın. `none`'dan yeniden eşleme yapıyorsanız, `none`'da temel çizgiyi ve `low`'da adayı çalıştırın.
Ardından isteği ve birkaç gerçek istemi bir test senaryosuna taşıyın ve çifti Apidog CLI'dan CI'da çalıştırın. `--env-var` bir çalıştırma için bir değişkeni geçersiz kılar, bu nedenle tek bir senaryo her iki modeli de kapsar:
npm install -g apidog-cli
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
--env-var "MODEL_ID=gpt-6-sol" -r cli,junit
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
--env-var "MODEL_ID=gpt-6.1-sol" -r cli,junit
Başarısız bir onay, işi başarısız kılar ve JUnit raporları size her iki çalıştırmayı yan yana sunar. Çalışmadan çalışmaya değişen çıktılar üzerindeki onaylar için, deterministik olmayan yapay zeka ajanlarını test etme'ye bakın.
Sıkça Sorulan Sorular
GPT-6.1 Sol, GPT-6 Sol'dan daha mı pahalı? Hayır. Her ikisi de 1M token başına 2 dolar giriş ve 10 dolar çıkış olarak listelenir. GPT-6.1 Sol'un önbelleğe alınmış girişi 0.20 dolara karşı 0.10 dolardır, bu nedenle önbellek ağırlıklı iş yükleri daha ucuza gelir.
`reasoning.effort: "none"` ile ne yapmalıyım? GPT-6.1 Sol ne `none` ne de `minimal`'i destekler. Her ikisini de `low`'a eşleyin, `temperature` ve `top_p`'yi kaldırın ve geçiş yapmadan önce değerlendirmelerinizi yeniden çalıştırın.
GPT-6.1 Sol'u Sohbet Tamamlamaları ile kullanabilir miyim? Evet, araç içermeyen istekler için. Araç çağırma, Yanıtlar API'sini gerektirir.
Ücretsiz bir GPT-6.1 Sol API katmanı var mı? Hayır. API çağrıları ilk istekten itibaren token başına faturalandırılır. GPT-6.1 Sol ücretsiz mi? en ucuz yolları kapsar.
Sonraki adım
İlk isteği kaydedin, mevcut çabanızla `gpt-6-sol` üzerinde, ardından `gpt-6.1-sol` üzerinde çalıştırın ve kendi trafiğinizden bir istem üzerinde `usage` ve çıktıyı karşılaştırın. Her iki çalıştırmayı da CI'da yeniden çalıştırabileceğiniz onaylar olarak saklamak için Apidog'u indirin. Bunun yerine Anthropic'i mi değerlendiriyorsunuz? GPT-6.1 Sol vs Claude Sonnet 5.5'e bakın.
