GPT-6 أسترا للمطورين: API، الأسعار، سياق 1M، والفروقات مع GPT-5.6 سول

دليل واجهة برمجة تطبيقات GPT-6 Astra: معرف النموذج gpt-6-astra، تسعير 10 دولارات/50 دولارًا مع سياق طويل، أسعار وضع الدفعة والوضع السريع، سياق 1.05 مليون، خمسة مستويات للجهد، والتغييرات الجذرية عن GPT-5.6 Sol.

Medy Evrard

5 سبتمبر 2026

GPT-6 أسترا للمطورين: API، الأسعار، سياق 1M، والفروقات مع GPT-5.6 سول

Apidog للمؤسسات

النشر على الخوادم المحلية

SSO و RBAC

متوافق مع SOC 2

استكشف Apidog للمؤسسات

أصدرت OpenAI نموذج GPT-6 Astra في 3 سبتمبر 2026، في البداية لمجموعة محدودة من المؤسسات، ثم على مدار الأيام التالية، لكل مستخدمي ChatGPT Plus و Pro و Business و Enterprise، وواجهة برمجة تطبيقات OpenAI، و Microsoft Azure، و AWS Bedrock. معرف النموذج هو gpt-6-astra، وهو يحمل نافذة سياق بحجم 1,050,000 رمز، وتصفه OpenAI بأنه “أفضل نموذج لهندسة البرمجيات حتى الآن”. وهو أيضًا أول نموذج تصنفه OpenAI بأنه حرج لقدرته على الأمن السيبراني، مما يحدد كيفية سلوكه في واجهة برمجة التطبيقات.

هذا هو الدليل العملي. يغطي هذا الدليل معرف النموذج ونقاط النهاية، وطلبك الأول، ومستويات الجهد الخمسة للاستدلال، وجدول الأسعار الكامل بما في ذلك أسعار السياق الطويل والوضع السريع، والتغييرات التي قد تعطل تكامل GPT-5.6 Sol، وما إذا كان السعر البالغ 2.5 ضعف سعر Sol الترويجي يستحق ذلك. تعد صفحة نموذج OpenAI هي المصدر الرسمي للأرقام أدناه. لمعرفة شعور العمل به، اقرأ تجربتنا العملية لمدة يومين؛ هذه المقالة تركز على واجهة برمجة التطبيقات (API).

الملخص

GPT-6 Astra في لمحة

العنصر القيمة
معرف النموذج gpt-6-astra
نافذة السياق 1,050,000 رمز
أقصى إخراج 128,000 رمز
تاريخ قطع المعرفة 30 أبريل 2026
الأنماط الإدخال: نص، صورة. الإخراج: نص
نقاط النهاية إكمال الدردشة، الردود، الدفعات
غير مدعوم الوقت الحقيقي، المساعدون، الضبط الدقيق
الميزات البث، المخرجات المهيكلة، استدعاء الدوال، البحث في الملفات، البحث في الويب، التخزين المؤقت للمطالبات، إدخال الصور
الأدوات المدمجة استخدام الكمبيوتر، البحث في الويب، البحث في الملفات، مفسر الأكواد، توليد الصور
جهد الاستدلال low، medium، high، xhigh، max
حدود المعدل (المستوى 5) 15,000 طلب في الدقيقة، 40,000,000 رمز في الدقيقة
متاح أيضًا على Microsoft Azure, AWS Bedrock; OpenRouter باسم openai/gpt-6-astra
معالجة البيانات الاحتفاظ بالبيانات صفرًا لعملاء واجهة برمجة التطبيقات المؤهلين

يتم إيقاف Astra افتراضيًا في مساحات عمل المؤسسات؛ ويجب على المسؤول تمكينه. على ChatGPT، يُحسب استخدام Astra ضمن بدل الاشتراك الحالي، كما تتلقى خطط Pro و Business و Enterprise أيضًا GPT-6 Astra Pro.

طلبك الأول

واجهة برمجة تطبيقات الردود (Responses API) هي السطح الأساسي، وهي مطلوبة للأدوات. استدعاء Python بسيط:

from openai import OpenAI

client = OpenAI()

response = client.responses.create(
    model="gpt-6-astra",
    reasoning={"effort": "medium"},
    input=[
        {"role": "developer", "content": "You are a senior API engineer. Bias towards action. Ask only when the answer would change the result."},
        {"role": "user", "content": "Review this OpenAPI operation for auth and validation gaps, then propose three test cases."},
    ],
)

print(response.output_text)
print(response.usage)

نفس الطلب في curl:

curl https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "reasoning": {"effort": "medium"},
    "input": "Review this OpenAPI operation for auth and validation gaps, then propose three test cases."
  }'

لا تزال ميزة إكمال الدردشة (Chat Completions) تعمل للنص العادي: قم بتبديل نقطة النهاية وشكل الرسالة، وأسقط أي حقول temperature أو top_p، والتي تنصح إرشادات OpenAI بإزالتها. في اللحظة التي تحتاج فيها إلى استدعاء دالة أو أداة مدمجة، انتقل إلى الردود (Responses). يغطي دليل واجهة برمجة تطبيقات الردود الخاصة بنا شكل الطلب بعمق.

أصبحت رسالة المطور أكثر أهمية مما كانت عليه في السابق. تشير إرشادات نموذج OpenAI إلى أن Astra "يطلب التوضيح بسهولة أكبر" من سابقاته ويوصي بتوجيهه للتحيز نحو العمل. كما أنه "أكثر حساسية للتعليمات الواردة في المهارات" والملفات المرفقة الأخرى، لذا اذكر أن تعليمات المستخدم هي الأولوية عند تعارضها. ويقوم افتراضيًا بإنشاء قوائم وجداول؛ إذا كنت تريد نصًا نثريًا، فاطلب ذلك.

جهد الاستدلال: خمسة مستويات، لا يوجد "none"

كشف GPT-5.6 عن ستة مستويات جهد من none إلى max. يكشف Astra عن خمسة: low، medium، high، xhigh، و max. نصيحة OpenAI للهجرة مباشرة: إذا كنت تستخدم none أو minimal اليوم، فانتقل إلى low وقم بالتقييم. كل شيء آخر يحتفظ بإعداداته الحالية.

يغير هذا الإزالة الجزء الأقل تكلفة من عبء عملك. كانت Luna عند none هي الخيار السريع لإكمال المهام التقليدية في عائلة GPT-5.6، ولا يوجد ما يعادلها في Astra. Astra هو نموذج استدلال في كل إعداد، ولهذا السبب يظل توجيه العمل الميكانيكي إلى GPT-5.6 Terra أو Luna وحجز Astra للمكالمات الصعبة هو النمط المنطقي.

على الطرف الآخر، max هو حيث تم تشغيل معايير الإطلاق (“درجات التقييم هي القصوى عند أي جهد”) وحيث قامت Artificial Analysis بقياس وقت وصول أول رمز يتجاوز سبع دقائق في تشغيلها بأقصى جهد. خصص ميزانية للانتظار قبل أن تخصص ميزانية للرموز.

تكلفة GPT-6 Astra

لكل مليون رمز، من صفحة تسعير OpenAI:

الفئة الإدخال الإدخال المخزن مؤقتًا الإخراج
قياسي $10.00 $1.00 $50.00
قياسي، سياق طويل (أكثر من 272 ألف رمز إدخال) $20.00 $2.00 $75.00
دفعة / مرن $5.00 $0.50 $25.00
دفعة، سياق طويل $10.00 $1.00 $37.50
الوضع السريع $20.00 $2.00 $100.00
الوضع السريع، سياق طويل $40.00 $4.00 $150.00

تُحاسب عمليات كتابة ذاكرة التخزين المؤقت بسعر 12.50 دولارًا لكل مليون. يوفر الوضع السريع “سرعة تصل إلى ضعفين من المعالجة القياسية بسعر ضعفين من السعر القياسي”.

للمقارنة، عائلة GPT-5.6 الحالية:

النموذج الإدخال الإدخال المخزن مؤقتًا الإخراج
GPT-5.6 Sol (عرض ترويجي حتى 21 نوفمبر 2026 على الأقل) $4.00 $0.40 $20.00
GPT-5.6 Terra $2.00 $0.20 $12.00
GPT-5.6 Luna $0.20 $0.02 $1.20

السعر المعلن لـ Sol هو 5 دولارات و 30 دولارًا؛ وقد تم تطبيق سعر 4 دولارات و 20 دولارًا منذ 21 أغسطس وتقول OpenAI إنه سيستمر حتى 21 نوفمبر على الأقل. بالمقارنة بذلك، تبلغ تكلفة Astra 2.5 ضعفًا للإدخال و 2.5 ضعفًا للإخراج. مقابل السعر المعلن لـ Sol، تبلغ التكلفة 2 ضعف و 1.67 ضعف.

مثال عملي. تشغيل عامل (Agent) يقرأ لقطة قاعدة بيانات بحجم 200,000 رمز مرة واحدة، ويعيد استخدامها كبادئة مخزنة مؤقتًا عبر 30 استدعاءً، ويكتب 60,000 رمز إخراج بالمجموع:

تظل النسبة عند 2.5 ضعف. ما تجادل به OpenAI، وما يجب عليك قياسه، هو أن Astra ينهي المهام بعدد أقل من الاستدعاءات وعدد أقل من رموز الإخراج. في Terminal-Bench 4.0، تدعي OpenAI أنه يكلف حوالي 9% أقل لكل مهمة من Sol على الرغم من السعر الأعلى، وحوالي 65% أقل من رموز الإخراج من Claude Opus 5 في اختبار Agents’ Last Exam. إذا انطبقت هذه الأرقام على عبء عملك، يمكن أن تتساوى فاتورة المهمة الواحدة. وإذا لم يكن الأمر كذلك، فستدفع 2.5 ضعف.

هناك عاملان يحافظان على خفض الفاتورة. عتبة 272 ألف هي التي يجب مراقبتها: المطالبة التي تتجاوزها تضاعف أسعار الإدخال وذاكرة التخزين المؤقت، لذا قم بتقليم مخرجات الأداة وتخزين البادئة الثابتة مؤقتًا. وتقلل الدفعات كل شيء إلى النصف للأعمال التي يمكن أن تنتظر.

الترحيل من GPT-5.6 Sol: ما الذي سيتعطل

نشرت OpenAI قائمة قصيرة، وتستحق أخذها حرفيًا.

  1. **اختفاء معلمات أخذ العينات.** قم بإزالة temperature و top_p و top_logprobs. في إكمال الدردشة (Chat Completions)، قم أيضًا بإزالة logprobs؛ وفي الردود (Responses)، قم بإزالة message.output_text.logprobs من include. توجيهات OpenAI هي إسقاطها بدلاً من الاعتماد على تجاهل واجهة برمجة التطبيقات لها، لذا ابحث في كود العميل الخاص بك.
  2. **أدنى مستوى للجهد هو low.** أي إعداد none أو minimal ينتقل إلى low.
  3. **تغير شكل الاحتفاظ بذاكرة التخزين المؤقت.** استبدل prompt_cache_retention بـ prompt_cache_options.ttl مضبوطًا على "30m". وضع التخزين المؤقت الصريح الذي قمت بإعداده لـ GPT-5.6 ينتقل بخلاف ذلك.
  4. **الأدوات تحتاج إلى الردود.** يتم دعم إكمال الدردشة للنص، ولكن استدعاء الدوال والأدوات المدمجة تتواجد في واجهة برمجة تطبيقات الردود (Responses API).
  5. **المطالبات تريد منك تقليل التحوط ومنها المزيد.** أضف سطر "التحيز نحو العمل"، أعلن أن تعليمات المستخدم لها الأسبقية على ملفات المهارات، واطلب نصًا نثريًا حيث تتوقع واجهة المستخدم الخاصة بك نصًا نثريًا.

لا يوجد شيء في القائمة يمس المخرجات المهيكلة أو تعريفات الدوال، لذا فإن المخطط الذي عمل على Sol سيعمل على Astra. التغيير السلوكي الذي تلاحظه معظم الفرق أولاً هو السؤال: قد تتوقف مطالبة Sol التي كانت تعمل حتى الانتهاء الآن بسؤال توضيحي. أجب عليه في رسالة المطور مقدمًا وسيتوقف عن السؤال.

هل يستحق 2.5 ضعف Sol؟

بالنسبة للعمل القائم على الوكلاء والعمل السياقي الطويل، تشير أرقام الإطلاق إلى نعم. جميع الأرقام أدناه تم تشغيلها بواسطة OpenAI، بأقصى جهد لكل نموذج:

المعيار GPT-6 Astra GPT-5.6 Sol Claude Fable 5.1
Terminal-Bench 4.0 57.9% 37.3% 55.8%
DeepSWE v1.1 74.1% 72.7% 67.4%
FrontierCode 1.1 Extended 64.5% 60.6% 63.6%
مهام ترحيل قاعدة البيانات الداخلية 63.9% 42.7% 57.8%
OSWorld 2.0 72.6% 65.7% -
MRCR v2 8-needle, 512K to 1M 96.3% 73.8% -
GPQA Diamond 96.0% 94.6% 93.7%
Humanity’s Last Exam (مع الأدوات) 57.2% - 65.0%

الفجوات في Terminal-Bench وترحيل قواعد البيانات هي التي تهم المطورين: 20 نقطة زيادة عن Sol في العمل الطرفي القائم على الوكلاء، ودرجة استرجاع السياق الطويل التي تجعل نافذة 1M قابلة للاستخدام بدلاً من كونها اسمية فقط. الفجوة في DeepSWE صغيرة، ولا يزال Claude Fable 5.1 يتفوق في اختبار Humanity’s Last Exam بفارق يقارب ثماني نقاط، لذا فهذا ليس انتصارًا ساحقًا. في فهرس Artificial Analysis المستقل، يحتل Astra المرتبة الثانية بين 202 نموذج. يقدم تحليل معيار Fable 5.1 الخاص بنا الجانب الآخر من هذه المقارنة.

حيث يحافظ Sol على دوره: الاستدعاءات القصيرة ذات الحجم الكبير حيث يسيطر الحد الأدنى للجهد ومعدل 2.5 ضعف، وأي شيء يحتاج إلى زمن استجابة بأسلوب none. حيث يستحق Astra دوره: تشغيل الوكلاء لفترات طويلة، سياق المستودع بالكامل، استخدام الكمبيوتر، وأي مهمة كان فيها وضع فشل Sol هو الانحراف أو الاستسلام.

اختبر التبديل قبل نشره

عملية الترحيل صغيرة بما يكفي لإنجازها في فترة ما بعد الظهر، ولكنها مهمة بما يكفي للقياس. في Apidog، احتفظ بمعرف النموذج كمتغير بيئة بحيث يتم تشغيل نفس الطلب المحفوظ مقابل gpt-5.6-sol و gpt-6-astra بمفتاح واحد. أضف تأكيدات على usage.input_tokens و usage.output_tokens وعدد الرموز المخزنة مؤقتًا، ثم أرسل مجموعة مهام تمثيلية عبر كليهما وقارن الإجماليات؛ هذا هو سؤال 2.5 ضعف الذي يتم الإجابة عليه بناءً على حركة المرور الخاصة بك بدلاً من مخطط الإطلاق.

ينتمي فحصان آخران إلى نفس المشروع. أرسل طلبًا لا يزال يحمل temperature وسجل ما يعود، لتتعلم السلوك في اختبار بدلاً من الإنتاج. وتأكد من أن المطالبة الطويلة تبقى أقل من 272 ألف رمز إدخال، لأن تجاوز هذا الحد يضاعف السعر بصمت. جدولة المجموعة كتراجع وقم بتنزيل Apidog إذا لم يكن لديك بعد؛ يعرض دليل واجهة برمجة تطبيقات GPT-5.6 نفس التجهيزات على الجيل السابق.

الأسئلة الشائعة

ما هو معرف نموذج GPT-6 Astra؟ gpt-6-astra، مع لقطة واحدة. يتم عرضه أيضًا عبر Azure و AWS Bedrock، وعلى OpenRouter باسم openai/gpt-6-astra.

هل يدعم GPT-6 Astra الضبط الدقيق أو واجهة برمجة تطبيقات الوقت الحقيقي؟ لا. تسرد صفحة النموذج إكمال الدردشة (Chat Completions)، والردود (Responses)، والدفعات (Batch) كمدعومة، بينما لا يتم دعم الوقت الحقيقي (Realtime)، والمساعدين (Assistants)، والضبط الدقيق (fine-tuning).

ما هي نافذة السياق وأقصى إخراج؟ 1,050,000 رمز إدخال و 128,000 رمز إخراج. تُحاسب المطالبات التي تتجاوز 272 ألف رمز إدخال بسعر السياق الطويل.

لماذا فشل طلبي بعد التبديل من Sol؟ على الأرجح بسبب بقايا temperature أو top_p، أو مستوى جهد none، أو prompt_cache_retention. أزال Astra كل هذه الثلاثة؛ راجع قائمة الترحيل أعلاه.

هل يمكن أن يتوقف الطلب من تلقاء نفسه؟ نعم. تقوم OpenAI بتشغيل مراقب عدم التوافق على طلبات استخدام الأدوات، وفي واجهة برمجة التطبيقات تتوقف المهمة التي تم وضع علامة عليها بدلاً من التوقف للمراجعة. تشغيل الوكلاء لفترات طويلة هو الأكثر عرضة لذلك، لذا اجعلها قابلة للاستئناف. يشرح منشور "عتبة الأمن السيبراني الحرجة" الضمانات وراء هذا السلوك.

ماذا تفعل هذا الأسبوع

انقل عبء عمل وكيل واحد إلى gpt-6-astra على واجهة برمجة تطبيقات الردود، قم بتجريد معلمات أخذ العينات، اضبط الجهد على medium، وقم بقياس الرموز والوقت الفعلي مقابل Sol على نفس المدخلات. إذا كانت التكلفة لكل مهمة متساوية أو أفضل، فقم بترحيل الباقي. إذا لم يكن الأمر كذلك، فلديك رقم، وهو أكثر مما ستحصل عليه معظم الفرق بحلول يوم الجمعة.

ممارسة تصميم API في Apidog

اكتشف طريقة أسهل لبناء واستخدام واجهات برمجة التطبيقات