OpenAI, GPT-6 Astra'yı 3 Eylül 2026'da önce sınırlı sayıda kuruluşa, ardından takip eden günlerde her ChatGPT Plus, Pro, Business ve Enterprise kullanıcısına, OpenAI API'sine, Microsoft Azure'a ve AWS Bedrock'a sundu. Model kimliği gpt-6-astra olup, 1.050.000 token bağlam penceresine sahiptir ve OpenAI bunu "bugüne kadarki yazılım mühendisliği için en iyi model" olarak adlandırmaktadır. Aynı zamanda OpenAI'ın siber güvenlik yeteneği açısından Kritik olarak derecelendirdiği ilk modeldir ve bu, API'deki davranışını şekillendirmektedir.
Bu pratik bir rehberdir. Model kimliğini ve uç noktalarını, ilk isteğinizi, beş akıl yürütme çaba seviyesini, uzun bağlam ve Hızlı mod oranları dahil olmak üzere tam fiyat tablosunu, bir GPT-5.6 Sol entegrasyonunu bozan değişiklikleri ve Sol'un promosyon fiyatı üzerindeki 2.5 kat fiyatın yeterli olup olmadığını kapsar. Aşağıdaki rakamlar için kaynak, OpenAI model sayfasıdır. Onunla çalışmanın nasıl bir his olduğunu öğrenmek için iki günlük uygulamalı yazımızı okuyun; bu yazı API'ye odaklanmaktadır.
TL;DR
- Model Kimliği
gpt-6-astra, tek bir anlık görüntü. Sohbet Tamamlamaları (Chat Completions), Yanıtlar (Responses) ve Toplu İş (Batch). Gerçek zamanlı (Realtime) yok, Asistanlar (Assistants) yok, ince ayar (fine-tuning) yok. Araç çağırma (Tool calling) için Yanıtlar API'si gerekir. - 1.050.000 token bağlam, 128.000 maksimum çıktı, bilgi kesme tarihi 30 Nisan 2026. Metin ve görsel giriş, metin çıkış.
- Standart fiyatlandırma: Milyon token başına 10$ giriş, 1$ önbelleğe alınmış okuma, 12.50$ önbelleğe yazma, 50$ çıkış. 272K giriş token'ını aşan istemler 20$ / 2$ / 75$ olarak faturalandırılır. Toplu İş (Batch) ve Esnek (Flex) yarı fiyatına. Hızlı mod (Fast mode) iki katı.
- Akıl yürütme çabası:
low,medium,high,xhigh,max.noneveminimalkaldırıldı. - Sol'dan ayrılanlar:
temperature,top_pve logprobs kaldırıldı;prompt_cache_retentionartıkprompt_cache_options.ttloldu. - GPT-5.6 Sol, en az 21 Kasım 2026'ya kadar sürecek promosyonda 4$ / 20$ olduğundan, Astra her iki tarafta da 2.5 kat daha pahalı.
GPT-6 Astra'ya bir bakış
| Öğe | Değer |
|---|---|
| Model Kimliği | gpt-6-astra |
| Bağlam penceresi | 1.050.000 token |
| Maksimum çıktı | 128.000 token |
| Bilgi kesme tarihi | 30 Nisan 2026 |
| Modlar | Giriş: metin, görsel. Çıkış: metin |
| Uç noktalar | Sohbet Tamamlamaları, Yanıtlar, Toplu İş |
| Desteklenmiyor | Gerçek zamanlı, Asistanlar, ince ayar |
| Özellikler | Akış, yapılandırılmış çıktılar, fonksiyon çağırma, dosya arama, web arama, istem önbelleğe alma, görsel giriş |
| Dahili araçlar | Bilgisayar kullanımı, web arama, dosya arama, kod yorumlayıcı, görsel oluşturma |
| Akıl yürütme çabası | low, medium, high, xhigh, max |
| Oran sınırları (Kademe 5) | 15.000 RPM, 40.000.000 TPM |
| Şuralarda da mevcut | Microsoft Azure, AWS Bedrock; OpenRouter'da openai/gpt-6-astra olarak |
| Veri işleme | Uygun API müşterileri için Sıfır Veri Saklama |
Kurumsal çalışma alanlarında Astra varsayılan olarak kapalıdır; bir yöneticinin onu etkinleştirmesi gerekir. ChatGPT'de Astra kullanımı mevcut abonelik hakkına dahil edilir ve Pro, Business ve Enterprise planları da GPT-6 Astra Pro'ya erişir.

İlk isteğiniz
Yanıtlar API'si birincil yüzeydir ve araçlar için gereklidir. Minimal bir Python çağrısı:
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6-astra",
reasoning={"effort": "medium"},
input=[
{"role": "developer", "content": "You are a senior API engineer. Bias towards action. Ask only when the answer would change the result."},
{"role": "user", "content": "Review this OpenAPI operation for auth and validation gaps, then propose three test cases."},
],
)
print(response.output_text)
print(response.usage)
Aynı istek curl'de:
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"reasoning": {"effort": "medium"},
"input": "Review this OpenAPI operation for auth and validation gaps, then propose three test cases."
}'
Sohbet Tamamlamaları düz metin için hala çalışır: uç noktayı ve mesaj yapısını değiştirin ve OpenAI'nin kaldırmanızı söylediği temperature veya top_p alanlarını bırakın. Fonksiyon çağırma veya yerleşik bir araca ihtiyaç duyduğunuz anda Yanıtlar'a geçin. Yanıtlar API'si rehberimiz, istek yapısını ayrıntılı olarak kapsar.
Geliştirici mesajı eskisinden daha önemli. OpenAI'nin model rehberliği, Astra'nın önceki modellerden "daha kolay açıklama istediğini" belirtiyor ve eyleme yönelik eğilim göstermesini söylemeyi öneriyor. Ayrıca "becerilerde" ve diğer ekli dosyalardaki talimatlara "daha duyarlı", bu nedenle çelişmeleri durumunda kullanıcı talimatlarının öncelikli olduğunu belirtin. Ve varsayılan olarak listeler ve tablolar kullanır; eğer düz yazı istiyorsanız bunu belirtin.
Akıl yürütme çabası: beş seviye, "yok" seviyesi kaldırıldı
GPT-5.6, none'dan max'a kadar altı çaba seviyesi sunuyordu. Astra beş seviye sunuyor: low, medium, high, xhigh ve max. OpenAI'nin geçiş tavsiyesi nettir: bugün none veya minimal kullanıyorsanız, low'a geçin ve değerlendirin. Diğer her şey mevcut ayarını korur.
Bu kaldırma, iş yükünüzün ucuz tarafını değiştiriyor. none seviyesindeki Luna, GPT-5.6 ailesindeki hızlı klasik tamamlama seçeneğiydi ve Astra'da bunun bir karşılığı yok. Astra her ayarda bir akıl yürütme modelidir, bu nedenle mekanik işi GPT-5.6 Terra veya Luna'ya yönlendirmek ve Astra'yı zor çağrılar için saklamak mantıklı bir model olmaya devam ediyor.
Diğer tarafta ise, max seviyesi lansman kıyaslamalarının yapıldığı yerdir ("değerlendirme puanları herhangi bir çabada maksimumdur") ve Artificial Analysis, maksimum çaba çalışmasında ilk token'a kadar yedi dakikadan fazla bir süre ölçmüştür. Token bütçesi ayırmadan önce gecikme için bütçe ayırın.
GPT-6 Astra ne kadara mal oluyor
Milyon token başına, OpenAI'nin fiyatlandırma sayfasından:
| Kademe | Giriş | Önbelleğe alınmış giriş | Çıkış |
|---|---|---|---|
| Standart | $10.00 | $1.00 | $50.00 |
| Standart, uzun bağlam (272K giriş üzeri) | $20.00 | $2.00 | $75.00 |
| Toplu İş / Esnek | $5.00 | $0.50 | $25.00 |
| Toplu İş, uzun bağlam | $10.00 | $1.00 | $37.50 |
| Hızlı mod | $20.00 | $2.00 | $100.00 |
| Hızlı mod, uzun bağlam | $40.00 | $4.00 | $150.00 |
Önbelleğe yazma işlemleri milyon başına 12.50$ olarak faturalandırılır. Hızlı mod, "Standart işlemin 2 katı hızına, Standart fiyatın 2 katına kadar" sunar.
Karşılaştırma için, mevcut GPT-5.6 ailesi:
| Model | Giriş | Önbelleğe alınmış giriş | Çıkış |
|---|---|---|---|
| GPT-5.6 Sol (en az 21 Kasım 2026'ya kadar promosyonlu) | $4.00 | $0.40 | $20.00 |
| GPT-5.6 Terra | $2.00 | $0.20 | $12.00 |
| GPT-5.6 Luna | $0.20 | $0.02 | $1.20 |
Sol'un liste fiyatı 5$ ve 30$'dır; 4$ ve 20$ oranı 21 Ağustos'tan beri geçerlidir ve OpenAI en az 21 Kasım'a kadar geçerli olacağını belirtiyor. Buna karşılık, Astra girişte 2.5 kat ve çıkışta 2.5 kat daha pahalıdır. Sol'un liste fiyatına göre ise 2 kat ve 1.67 kat daha pahalıdır.
Bir örnek. Bir ajan çalışması, 200.000 token'lık bir kod tabanı anlık görüntüsünü bir kez okur, 30 çağrı boyunca önbelleğe alınmış bir önek olarak yeniden kullanır ve toplamda 60.000 token çıktı yazar:
- Astra: İlk okuma için 2.00$, ardından her biri 0.20$ olan 29 önbelleğe alınmış okuma (5.80$), artı 3.00$ çıktı. Yaklaşık 10.80$.
- Promosyonlu Sol: İlk okuma için 0.80$, önbelleğe alınmış okumalar için 2.32$, 1.20$ çıktı. Yaklaşık 4.32$.
Oran 2.5 kat olarak devam ediyor. OpenAI'nin savunduğu ve sizin ölçmeniz gereken şey, Astra'nın daha az çağrıda ve daha az çıktı token'ıyla tamamlanmasıdır. Terminal-Bench 4.0'da, daha yüksek orana rağmen görev başına maliyetin Sol'dan yaklaşık %9 daha düşük olduğunu ve Agents' Last Exam'da Claude Opus 5'ten yaklaşık %65 daha az çıktı token'ı kullandığını iddia ediyor. Bunlar iş yükünüz için geçerliyse, görev başına fatura eşitlenebilir. Geçerli değilse, 2.5 kat daha fazla ödersiniz.
Faturayı düşük tutan iki kaldıraç var. Dikkat edilmesi gereken eşik 272K'dır: bu eşiği aşan bir istem, giriş ve önbellek oranlarını iki katına çıkarır, bu nedenle araç çıktılarını kırpın ve statik öneki önbelleğe alın. Ve Toplu İş (Batch) ise bekleyebilecek işler için her şeyi yarıya indirir.
GPT-5.6 Sol'dan geçiş: neler bozuluyor
OpenAI kısa bir liste yayınladı ve bunu harfiyen almakta fayda var.
- Örnekleme parametreleri kaldırıldı.
temperature,top_pvetop_logprobs'u kaldırın. Sohbet Tamamlamaları'nda ayrıcalogprobs'u; Yanıtlar'da iseinclude'danmessage.output_text.logprobs'u kaldırın. OpenAI'nin rehberliği, API'nin bunları göz ardı etmesine güvenmek yerine, onları bırakmanız yönündedir, bu nedenle istemci kodunuzu kontrol edin. - Çaba tabanı
low'dur. Herhangi birnoneveyaminimalayarılow'a geçer. - Önbellek saklama şekli değişti.
prompt_cache_retentionyerineprompt_cache_options.ttl'yi"30m"olarak ayarlayın. GPT-5.6 için kurduğunuz açık önbellekleme modu aksi takdirde taşınır. - Araçlar Yanıtlar'a ihtiyaç duyar. Sohbet Tamamlamaları metin için desteklenir, ancak fonksiyon çağırma ve yerleşik araçlar Yanıtlar API'sinde bulunur.
- İstemler sizden daha az, ondan daha fazla garanti ister. Eyleme yönelik eğilimi belirten satırı ekleyin, kullanıcı talimatlarının beceri dosyalarına göre öncelikli olduğunu belirtin ve kullanıcı arayüzünüzün düz yazı beklediği yerlerde düz yazı isteyin.
Listede yapılandırılmış çıktılara veya fonksiyon tanımlarına dokunan hiçbir şey yoktur, bu nedenle Sol'da çalışan bir şema Astra'da da çalışır. Çoğu ekibin ilk fark ettiği davranış değişikliği sorma eylemidir: tamamlanmış bir Sol istemi artık açıklayıcı bir soruyla durabilir. Bu soruyu geliştirici mesajında baştan yanıtlayın ve sormayı bırakacaktır.
Sol'a göre 2.5 katına değer mi?
Ajan tabanlı ve uzun bağlamlı işler için, lansman sayıları evet diyor. Aşağıdaki tüm rakamlar OpenAI tarafından her model için en iyi çabayla yürütülmüştür:
| Kıyaslama | GPT-6 Astra | GPT-5.6 Sol | Claude Fable 5.1 |
|---|---|---|---|
| Terminal-Bench 4.0 | %57.9 | %37.3 | %55.8 |
| DeepSWE v1.1 | %74.1 | %72.7 | %67.4 |
| FrontierCode 1.1 Genişletilmiş | %64.5 | %60.6 | %63.6 |
| Dahili veritabanı geçiş görevleri | %63.9 | %42.7 | %57.8 |
| OSWorld 2.0 | %72.6 | %65.7 | - |
| MRCR v2 8-iğne, 512K'dan 1M'ye | %96.3 | %73.8 | - |
| GPQA Diamond | %96.0 | %94.6 | %93.7 |
| İnsanlığın Son Sınavı (araçlarla) | %57.2 | - | %65.0 |
Terminal-Bench ve veritabanı geçişindeki farklar geliştiriciler için önemlidir: ajan tabanlı terminal işlerinde Sol'a göre 20 puanlık bir fark ve 1M'lik pencereyi nominal yerine kullanılabilir kılan uzun bağlam alma puanı. DeepSWE farkı küçük ve Claude Fable 5.1 hala İnsanlığın Son Sınavı'nda neredeyse sekiz puanla önde, bu yüzden tam bir zafer değil. Artificial Analysis'in bağımsız endeksinde Astra, 202 model arasında ikinci sırada yer alıyor. Fable 5.1 kıyaslama analizimiz, bu karşılaştırmanın diğer tarafını sunuyor.
Sol'un işini koruduğu yerler: çaba tabanı ve 2.5 kat oranının baskın olduğu kısa, yüksek hacimli çağrılar ve none tarzı gecikmeye ihtiyaç duyan her şey. Astra'nın değerini gösterdiği yerler: uzun ajan çalıştırmaları, tüm depo bağlamı, bilgisayar kullanımı ve Sol'un başarısızlık modunun sapma veya vazgeçme olduğu her görev.
Değişimi yayınlamadan önce test edin
Geçiş, bir öğleden sonra yapılabilecek kadar küçük ve ölçülebilecek kadar önemlidir. Apidog'da model kimliğini bir ortam değişkeni olarak tutun, böylece aynı kaydedilmiş istek tek bir anahtarla gpt-5.6-sol ve gpt-6-astra'ya karşı çalışır. usage.input_tokens, usage.output_tokens ve önbelleğe alınmış token sayımı üzerinde doğrulama (assertion) ekleyin, ardından her ikisine de temsili bir görev kümesi gönderin ve toplamları karşılaştırın; bu, kendi trafiğinizle yanıtlanan 2.5 kat sorusudur, bir lansman grafiğiyle değil.
Aynı projeye iki kontrol daha ekleyin. Hala temperature taşıyan bir istek gönderin ve geri döneni kaydedin, böylece davranışı üretimde değil, bir testte öğrenirsiniz. Ve uzun bir istemin 272K giriş token'ının altında kaldığını doğrulayın, çünkü bu sınırı aşmak oranı sessizce ikiye katlar. Bu seti bir regresyon olarak planlayın ve henüz yoksa Apidog'u İndirin; GPT-5.6 API rehberi, önceki nesilde aynı düzeni gösterir.
SSS
- GPT-6 Astra model kimliği nedir?
gpt-6-astra, tek bir anlık görüntü ile. Ayrıca Azure ve AWS Bedrock aracılığıyla ve OpenRouter'daopenai/gpt-6-astraolarak da sunulur. - GPT-6 Astra ince ayarı veya Gerçek Zamanlı API'yi destekliyor mu? Hayır. Model sayfası, Sohbet Tamamlamaları, Yanıtlar ve Toplu İş'i desteklenenler olarak listelemekte, Gerçek Zamanlı, Asistanlar ve ince ayar ise desteklenmemektedir.
- Bağlam penceresi ve maksimum çıktı nedir? 1.050.000 giriş token'ı ve 128.000 çıktı token'ı. 272K giriş token'ının üzerindeki istemler uzun bağlam oranı üzerinden faturalandırılır.
- Sol'dan geçtikten sonra isteğim neden başarısız oldu? Büyük olasılıkla kalan bir
temperatureveyatop_p,noneçaba seviyesi veyaprompt_cache_retentionnedeniyle. Astra bu üçünü de kaldırdı; yukarıdaki geçiş listesine bakın. - Bir istek kendiliğinden durabilir mi? Evet. OpenAI, araç kullanan istekler üzerinde bir uyumsuzluk monitörü çalıştırır ve API'de işaretlenen bir görev, inceleme için duraklamak yerine durur. Uzun ajan çalıştırmaları en çok maruz kalanlardır, bu yüzden onları devam ettirilebilir yapın. Kritik siber eşik yazısı, bu davranışın arkasındaki güvenlik önlemlerini açıklıyor.
Bu hafta ne yapılmalı
Bir ajan iş yükünü Yanıtlar API'sinde gpt-6-astra'ya taşıyın, örnekleme parametrelerini kaldırın, çabayı medium olarak ayarlayın ve aynı girdilerle Sol'a karşı token'ları ve gerçek zamanı ölçün. Eğer görev başına maliyet aynı veya daha iyi çıkarsa, kalanları taşıyın. Eğer çıkmazsa, elinizde bir sayı olur ki bu, çoğu ekibin Cuma'ya kadar sahip olacağından daha fazlasıdır.
