GPT-6 Astra Bilgisayarınızı Kullanabilir. Bunun Yerine OpenAPI Spesifikasyonunuzu Verin.

GPT-6 Astra, görev başına 40 dakikada OSWorld'de %72,6 puan alıyor. API ekipleri için, ona OpenAPI belirtimini vermek daha hızlı, daha ucuz ve doğrulanabilir. Ne zaman tıklanacağı, ne zaman çağrı yapılacağı ve nasıl ayarlanacağı.

INEZA Felin-Michel

INEZA Felin-Michel

5 September 2026

GPT-6 Astra Bilgisayarınızı Kullanabilir. Bunun Yerine OpenAPI Spesifikasyonunuzu Verin.

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

GPT-6 Astra'nın öne çıkan özelliği, bilgisayar kullanabilmesidir. Bir modelin bir demoda tıklayarak ilerleyip sonra açılır menüde kaybolduğu 2025 anlamında değil. OpenAI lansman yazısında, Astra, OSWorld 2.0'da görev başına yaklaşık 40 dakikada %72,6 puan alıyor, form dolduruyor, CRM'leri güncelliyor, yazılım yüklüyor ve kendi oluşturduğu bir sitede ön yüz QA kontrolleri yapıyor. OpenAI bunu “dünyanın en iyi bilgisayar kullanma modeli” olarak adlandırıyor ve bu kez demolar bu iddiayı destekliyor.

API'ler oluşturuyor veya test ediyorsanız, bu yetenek cazip bir kısayolu işaret ediyor: Astra'yı uygulamanıza yöneltin ve tıklamasına izin verin. Bu yazı, daha az etkileyici ama daha faydalı bir şey yapmanız gerektiğini savunuyor. Ona sözleşmeyi verin. Bir OpenAPI spesifikasyonu, bir model için ekrandan daha hızlı, daha ucuz ve daha doğrulanabilir bir arayüzdür ve bu kadar yetenekli bir model bunu iyi kullanacaktır. İki günlük uygulamalı testimizde Astra'nın bu geçişi kendi başına yaptığını gördük ve yazının geri kalanı bunun neden doğru bir karar olduğunu ve Apidog ile nasıl kurulacağını açıklıyor.

Özetle

GPT-6 Astra'nın bilgisayar kullanımı gerçek: OSWorld 2.0'da %72,6, ScreenSpot-Pro'da %92,7 ve bilgisayar kullanım görevlerini GPT-5.6 Sol deneyiminden 1,9 kat daha hızlı bitiren bir Codex altyapısı var. Ancak ekran yönlendirmesi görev başına onlarca dakika ve birçok görüntü belirteci maliyetine neden olur ve bu, API'yi değil, kullanıcı arayüzünü test eder. Kendi hizmetleriniz için Astra'ya OpenAPI spesifikasyonunu Apidog MCP Sunucusu aracılığıyla veya işlev araçları olarak verin, test senaryolarını yazmasına izin verin ve bunları CI'da Apidog CLI'dan çalıştırın. Bilgisayar kullanımını API'si olmayan yüzeyler için saklayın.

GPT-6 Astra'da bilgisayar kullanımı neler yapabilir

Bu yetenek "bir web sitesine göz atmaktan" daha geniştir. OpenAI, sıkıcı bilgi işlerini (çevrimiçi formlar, CRM kayıtları, takvimler), bir belge düzenleyicide araştırma ve taslak oluşturmayı, çizimlerle bilimsel veri analizini, ChatGPT Siteleri aracılığıyla bir web sitesi oluşturmayı ve barındırmayı ve bu sitede ön yüz QA'sını listeliyor. Demolar arasında KiCad'de bir baskılı devre kartı tasarlamak ve Blender'da bir ev modellemek de bulunuyor.

Tüm OpenAI tarafından lansman yazısından alınan kıyaslama rakamları:

Kıyaslama Testi GPT-6 Astra GPT-5.6 Sol Claude Opus 5
OSWorld 2.0 (çevrimdışı set, kısmi puan) Görev başına ~40 dakikada %72,6 Görev başına ~75 dakikada %65,7 %70,2
ScreenSpot-Pro (araçsız) %92,7 %76,9 -
Ajanların Son Sınavı %59,3 %53,6 %55,5
AutomationBench %41,4 %18,1 %26,9

Skorlardan daha önemli iki detay var. Astra, OSWorld görevlerini Sol'dan yaklaşık %47 daha kısa sürede tamamlıyor ve Ajanların Son Sınavı'nda en yüksek puanlı ayarlarda Opus 5'ten yaklaşık %65 daha az çıktı belirteci kullanıyor. Modelin yanı sıra OpenAI, Codex altyapısını güncelleyerek bilgisayar kullanma görevlerinin tamamlanmasını Mind2Web'deki mevcut Sol deneyiminden 1,9 kat daha hızlı hale getirdi. Daha hızlı döngüler, daha ucuz döngüler anlamına gelir; bu da belirteç başına ödeme yapan herkes için önemli olan kısımdır.

Davranış da gelişti. Astra, sadece cevabın sonucu değiştireceği zaman odaklanmış sorular soruyor, görevin ortasında yönlendirdiğinizde yönünü koruyor ve Codex'te cevabınıza bağlı olmayan işleri sürdürürken eşzamansız olarak soru sorabiliyor. OpenAI'ın dahili bilgisayar kullanım güvenliği kıyaslama testinde, daha düşük daha iyi olduğu yerlerde, Astra %2,4 puan alırken Sol'un %22,0 puanına karşılık geliyor.

40 dakikalık bir görevin maliyeti nedir

Bilgisayar kullanımı bir döngüdür: ekran görüntüsü al, düşün, eyleme geç, tekrar ekran görüntüsü al. Her ekran görüntüsü bir görüntü girdisidir, her adım konuşmayı o ana kadar taşır ve 40 dakika süren bir görev yüzlerce adım gerektirir. Astra'nın standart fiyatıyla, milyon girdi belirteci başına 10 dolar ve milyon çıktı başına 50 dolar, 272 bin girdi belirtecini aşan istemler ise milyon başına 20 dolardan faturalandırılırken, tam geçmişini bağlamda tutan uzun bir oturum, bitmeden önce uzun bağlam fiyatlandırmasına kayar. İstem önbellekleme, tekrarlanan ön ekle milyon önbelleğe alınmış belirteç başına 1 dolardan yardımcı olur, ancak ekran görüntüleri her adımda yenidir.

Bunu sözleşme yoluyla karşılaştırın. OpenAPI spesifikasyonunuz tek bir ön ektir, bir kez önbelleğe alınır. Modelin yazdığı her test birkaç yüz belirteç JSON'dır. Bu testin her çalıştırılması, model tarafında hiçbir maliyeti olmayan bir HTTP çağrısıdır, çünkü bir test senaryosu bir kez yazıldıktan sonra yürütmek için bir modele ihtiyaç duymaz.

Parayla ilgisi olmayan ikinci bir maliyet var. OpenAI'ın güvenlik genel bakışında, üretim uyumsuzluk izleyicisinin "bazen yasal işleri yavaşlatabileceğini, duraklatabileceğini veya durdurabileceğini" belirtiyor ve "bir ajanın uzun süre çalıştığı görevlere" dikkat çekiyor. ChatGPT veya Codex'te eylemi incelemeniz istenecektir. API'de görev durur. 40 dakikalık bir ekran yönlendirme oturumu, bu kesintiye en çok maruz kalan görev şeklidir. Beş saniyelik bir API çağrısı ise böyle değildir.

Bilgisayar kullanımı sözleşmeye karşı: her biri ne zaman kazanır

Durum Daha İyi Araç Neden
Kendi API'nizi Test Etme Spesifikasyon Deterministik, yeniden çalıştırması ucuz, gerçek sözleşmeyi doğrular
CI'da Regresyon Paketi Spesifikasyon Senaryolar döngüde bir model olmadan çalışır
API'si Olmayan Üçüncü Taraf Portal Bilgisayar Kullanımı Teslim edilecek bir sözleşme yok
Yayın Öncesi Uçtan Uca Ön Yüz QA Bilgisayar Kullanımı Test edilen şey kullanıcı arayüzüdür
Eski Masaüstü Aracı Bilgisayar Kullanımı Sadece bir ekran mevcut
Belgelerin davranışla eşleşip eşleşmediğini kontrol etme Spesifikasyon, sonra kullanıcı arayüzü Belgelenmiş isteği gönderin, yanıtı karşılaştırın, ardından oluşturulan sayfayı hızlıca kontrol edin

Ayrım, neyi test ettiğinizdir. Bilgisayar kullanımı pikselleri test eder. Spesifikasyon, vaadi test eder. Bir ön yüz bozulduğunda, API genellikle hala sorunsuz çalışır ve API bozulduğunda, ön yüz bunu kullanıcı dostu bir hatanın arkasına gizleyebilir. Her ikisi de önemlidir, ancak API ekipleri vaadi teslim eder, bu yüzden önce vaadi test edin.

Astra'ya API sözleşmenizi nasıl teslim edersiniz

Astra'ya bir spesifikasyon vermenin üç yolu vardır ve bunlar birbiri üzerine inşa edilebilir.

1. Dosyayı verin. OpenAPI spesifikasyonunu Apidog projenizden dışa aktarın (veya önce mevcut spesifikasyonunuzu Apidog'a aktarın) ve isteğe dahil edin. Astra'nın 1.050.000 belirteçlik bağlam penceresi, herhangi bir gerçek dünya spesifikasyonunu tek bir istemde tutar ve OpenAI'ın MRCR geri çağırma testi, 512K ila 1M aralığında %96,3 doğrulukta kaldığını gösterir; Sol ise bu aralıkta %73,8'e düşer. Büyük spesifikasyonlar artık parçalama sorunu olmaktan çıkar.

2. Projeyi MCP aracılığıyla bağlayın. Apidog MCP Sunucusu, Apidog projenizi, yayınlanmış belgelerinizi veya bir OpenAPI dosyasını MCP özellikli herhangi bir istemciye açar, böylece Astra eski bir dışa aktarım yerine mevcut sözleşmeyi okur. Codex ve masaüstü ajanları, çalıştıkça uç nokta tanımlarını çekebilir. Testimizde Astra'nın spesifikasyonu kendi başına bulup okumasını sağlayan kurulum buydu.

3. Spesifikasyonu araçlara dönüştürün. Programatik kullanım için, uç noktaları işlev araçlarına dönüştürün ve Astra'yı Yanıtlar API'si aracılığıyla çağırın; bu kalıbı OpenAPI'dan AI ajan araçlarına yazımızda ele alıyoruz. Model sayfası, Astra'nın özellikleri arasında işlev çağrısı, yapılandırılmış çıktılar ve dosya aramasını listeler ve araç çağırması Sohbet Tamamlama yerine Yanıtlar API'sini gerektirir.

Astra'dan bir spesifikasyondan test senaryoları taslağı hazırlamasını isteyen minimal bir istek şöyle görünür:

curl https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "reasoning": {"effort": "medium"},
    "input": [
      {"role": "developer", "content": "API test senaryoları yazıyorsunuz. Eyleme yönelik olun. Sadece cevap test tasarımını değiştiriyorsa soru sorun. Şemayla eşleşen JSON çıktısı verin."},
      {"role": "user", "content": "İşte OpenAPI 3.1 spesifikasyonumuz. Her kaynak için bir test senaryosu taslağı oluşturun: başarılı senaryo (happy path), yetkilendirme sınırı ve her biri için bir olumsuz durum.\n\n"}
    ],
    "text": {"format": {"type": "json_schema", "name": "scenarios", "schema": {"type": "object", "properties": {"scenarios": {"type": "array"}}, "required": ["scenarios"]}}}
  }'

OpenAI'ın model rehberinden iki not. Astra'da `none` veya `minimal` çaba yoktur, bu yüzden `low` veya `medium`dan başlayın ve önceki modellere göre "daha kolay açıklama ister", bu nedenle geliştirici mesajındaki "eyleme yönelik olma" ifadesi gerçek bir iş görüyor.

4. Senaryoları model olmadan çalıştırın. Oluşturulan senaryoları Apidog'a aktarın, durum kodları ve yanıt şemaları üzerinde iddialar ekleyin ve bunları Apidog CLI'dan pipeline'ınızda çalıştırın. Model testleri bir kez yazdı. CI'niz bunları binlerce kez ücretsiz olarak çalıştırır. Ekonomik argüman tek cümleyle budur ve bu nedenle Apidog'u İndir bu iş akışında API anahtarının yanında yer alır.

Astra onlara saygı duysa bile koruyucu önlemleri sürdürün

OpenAI'ın Astra için yayınladığı uyum sonuçları en iyisidir. Hugging Face olayından sonra oluşturulan honeypot testinde, Sol yetkili hedefin %48'inde dışına çıkarken, Astra bunu %0 oranında yaptı. Astra, bir Codex otomatik inceleme reddini, ret kasten atlatılabilir şekilde yapılandırılmış olsa bile, asla atlatmaya çalışmadı. Dolaylı istem enjeksiyonu sağlamlığı %96,23'ten %99,79'a yükselmiştir.

Bunların hiçbiri kapı ihtiyacını ortadan kaldırmaz. Bu, kapıların daha az sıklıkta tetiklendiği anlamına gelir. 1 milyon belirteç penceresine, Kritik siber derecelendirmesine ve API'nize rastgele istekler gönderme yeteneğine sahip bir model, yine de kapsamlı kimlik bilgileriyle, değişikliklerde bir onay kapısıyla ve her çağrının iziyle hazırlık ortamında çalıştırılmalıdır. Astra'nın izleyicisi bir çalışmayı görev ortasında durdurabilir, bu nedenle her uzun işi devam ettirilebilir olarak ele alın. Deterministik olmayan ajanlar için test tasarımı değişmeden geçerlidir: sözleşmeyi doğrulayın, transkripti değil.

Bilgisayar kullanımının hala yerini koruduğu yerler

Bunu "asla tıklamasına izin verme" olarak okumayın. Üç durum ekranda daha iyidir. API'si olmayan bir iş ortağı portalı veya yönetici konsolu. Bir insanın aksi takdirde elle yapacağı yayın günü ön yüz kontrolü. Kullanıcı arayüzünün tek yüzey olduğu eski bir masaüstü aracı. Astra, bu işlerin devredilmeye değer olduğu ilk modeldir ve Codex altyapısındaki hız artışı, bu işleri gecelik olarak çalıştırılabilecek kadar ucuz hale getiriyor.

Pratik kural: bir sözleşme varsa sözleşmeye ulaşın, yoksa ekrana ulaşın.

Sıkça Sorulan Sorular

GPT-6 Astra'nın bilgisayar kullanımı API aracılığıyla çalışır mı? Evet. Bilgisayar kullanımı, Yanıtlar API'sinde Astra'nın desteklediği araçlar arasında web araması, dosya araması, kod yorumlayıcı ve görüntü oluşturma ile birlikte listelenmiştir. Uygulamanız ortamı sağlar ve modelin önerdiği eylemleri yürütür. API ayrıca OpenAI'ın koruyucu önlemlerinin daha katı tarafını da içerir: uyumsuzluk izleyicisi tarafından duraklatılan bir görev, inceleme beklemek yerine durur.

Ona ne kadar büyük bir spesifikasyon verebilirim? Bağlam penceresi 1.050.000 belirteç ve 128.000 belirteç çıktı kapasitesine sahiptir. Yüzlerce uç noktaya ve tam şemaya sahip bir spesifikasyon, yer kalacak şekilde sığar. 272 bin girdi belirtecini aşan istemler, girdi ve önbellek oranlarının 2 katından faturalandırılır, bu nedenle spesifikasyon ön ekini önbelleğe alın ve test başına mesajları küçük tutun.

Spesifikasyonda olmayan uç noktaları halüsinasyon olarak görür mü? Önceki modellere göre daha az. OpenAI'ın dahili halüsinasyon kıyaslama testinde, daha düşük daha iyi olduğu yerlerde, Astra %4,2 puan alırken Sol'un %12,2'sine karşılık gelir ve kendi yeteneklerini yanlış tanıtma olasılığı üç kat daha azdır. Yapılandırılmış çıktılar ve Apidog'da şema doğrulamalı bir çalıştırma geri kalanını yakalar; bu yüzden sözleşme testi son sözdür, model değil.

Bu, test oluşturma için GPT-5.6 Sol'dan daha ucuz mu? Belirteç başına, hayır. Astra, Sol'un tanıtım amaçlı 4 ve 20 dolarına karşılık milyon belirteç başına 10 ve 50 dolar maliyetindedir. Tamamlanmış görev başına, OpenAI, Astra'nın çok daha az belirteç kullandığını ve spesifikasyon öncelikli iş akışının model maliyetini tek seferlik bir gider haline getirdiğini iddia ediyor. Karar vermeden önce kendi spesifikasyonunuz üzerinde ölçün; API rehberi, her ikisini yan yana nasıl karşılaştıracağınızı gösterir.

Kısa versiyon

GPT-6 Astra bilgisayarınızı kullanabilir ve API'si olmayan yüzeyler için bu gerçek bir hediyedir. Sahip olduğunuz API için ekran, yavaş yoldur. Modele sözleşmeyi verin, senaryoları yazmasına izin verin, bunları CI'da çalıştırın ve geçitleri koruyun. Astra bu sonuca yirmi dakika içinde kendi başına ulaştı. Ekibiniz oradan başlayabilir.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin