GPT-5.6 الوضع الفائق: نموذج ذكاء اصطناعي واحد يولد وكلاءه الفرعيين

يتيح وضع GPT-5.6 الفائق لنموذج واحد إنشاء وكلاء فرعيين خاصين به. ما هي التغييرات التي يحدثها وضع "الجهد الأقصى" مقارنة بوضع "الفائق" على تصميم الوكيل، وزمن الاستجابة، والتكلفة، مشروحة للمطورين.

Ashley Innocent

Ashley Innocent

26 يونيو 2026

GPT-5.6 الوضع الفائق: نموذج ذكاء اصطناعي واحد يولد وكلاءه الفرعيين

Apidog للمؤسسات

النشر على الخوادم المحلية

SSO و RBAC

متوافق مع SOC 2

استكشف Apidog للمؤسسات

لقد أخفت OpenAI الجزء الأكثر إثارة للاهتمام من إطلاق GPT-5.6 Sol تحت أنباء البوابة الحكومية. إلى جانب عائلة النماذج الجديدة، أطلقت OpenAI تحكمين جديدين في الاستدلال: "أقصى" جهد استدلالي يمنح Sol أقصى وقت للتفكير، ووضع "Ultra" الذي، وفقًا لـ OpenAI، "يتجاوز الوكيل الواحد من خلال الاستفادة من الوكلاء الفرعيين لتسريع العمل المعقد." هذا الأخير يمثل تحولًا حقيقيًا في طريقة عمل استدعاء نموذج واحد.

أولًا، واقع الوصول. يتوفر GPT-5.6 Sol في معاينة محدودة عبر واجهة برمجة تطبيقات OpenAI (API) وCodex فقط. إنه ليس متاحًا في ChatGPT بعد، وهو مقيد بحوالي 20 شريكًا تمت الموافقة على أسمائهم فرديًا من قبل الحكومة الأمريكية. لذلك لا يمكنك تشغيل وضع Ultra اليوم ما لم تكن واحدًا منهم. هذه المقالة مخصصة للمطورين الذين يرغبون في فهم ما يغيره استخدام الوكلاء الفرعيين داخل استدعاء نموذج واحد في تصميم الوكلاء، وزمن الاستجابة، والتكلفة، حتى تتمكن من تحديد ما إذا كان الأمر يستحق الانتظار. تقول OpenAI إن التوفر العام في ChatGPT وCodex وAPI سيأتي في الأسابيع القادمة.

زر

ملخص سريع (TL;DR)

ما يفعله جهد التفكير "الأقصى"

لقد سمحت OpenAI بالفعل بضبط مدى صعوبة عمل نموذج التفكير من خلال إعداد "جهد التفكير". يضيف GPT-5.6 مستوى أعلى جديدًا يسمى "أقصى". عند ضبطه، يحصل Sol على أقصى وقت للتفكير بعمق قبل أن يجيب.

فكر في "أقصى" كتحويل مقبض تعرفه بالفعل. لا يزال النموذج يعمل كووكيل واحد ولا يزال ينتج سلسلة استدلال واحدة. أنت تدفع مقابل المزيد من هذا الاستدلال، في التوكنات والوقت الفعلي، لاستخلاص أقصى قدر من الدقة في مشكلة صعبة. المقايضة مألوفة: التفكير الأعمق يكلف أكثر ويستغرق وقتًا أطول، ومعظم المطالبات لا تحتاج إليه. "أقصى" هو الإعداد الصحيح عندما تتطلب مشكلة صعبة واحدة الكثير من التفكير الإضافي، مثل إعادة هيكلة دقيقة أو خطة كثيفة حسابيًا. إنه لا يغير شكل العمل. إنه يغير المدة التي يقضيها العامل الواحد فيه.

ما يغيره وضع "Ultra"

وضع Ultra مختلف تمامًا. وفقًا لـ OpenAI، وضع Ultra "يتجاوز الوكيل الواحد من خلال الاستفادة من الوكلاء الفرعيين لتسريع العمل المعقد." بدلاً من أن يعمل نموذج واحد على معالجة مشكلة في سلسلة واحدة، يقوم النموذج بتنسيق العديد من الوكلاء الفرعيين الذين يتناولون أجزاء من المهمة، ثم يجمع عملهم مرة أخرى.

إذا كنت قد قمت ببناء أنظمة وكلاء يدويًا، فقد فعلت هذا بالفعل بالطريقة الصعبة. تكتب منسقًا. يقوم هذا المنسق بتقسيم مهمة إلى مهام فرعية، ثم يوزعها على استدعاءات نموذج منفصلة، ثم يجمع النتائج وينتج إجابة نهائية. أنت تدير المطالبات، والحالة، والمحاولات، وكود الربط بين كل خطوة.

يعمل وضع Ultra على دمج هذا النمط داخل استدعاء النموذج. تطلب مرة واحدة. يقرر النموذج كيفية تقسيم العمل، ويشغل الوكلاء الفرعيين، ويعيد النتيجة. التنسيق الذي كنت تمتلكه يحدث الآن خلف استدعاء واحد لواجهة برمجة التطبيقات. هذا هو الجزء المبتكر حقًا. بالنسبة للسياق الأوسع للعائلة، يغطي نظرة عامة على GPT-5.6 Sol المستويات والتسمية وسبب حظر كل شيء خلف معاينة حكومية.

ما يغيره في تصميم الوكلاء

نقل التنسيق إلى النموذج يغير ثلاثة أمور في طريقة البناء.

كود ربط أقل. يمكن أن يتقلص منطق التفكيك والتوزيع والدمج الذي كان يعيش في تطبيقك. تصف الهدف وتدع النموذج يتعامل مع التقسيم. هذا يعني مساحة عمل أقل للصيانة وعدد أقل من الأماكن التي قد يخرج فيها التنسيق الخاص بك عن التزامن مع سلوك النموذج.

تحكم أقل. الجانب الآخر هو أنك تتنازل عن الرؤية. عندما تمتلك المنسق، ترى كل مهمة فرعية، ونتيجة وسيطة، ومحاولة، ويمكنك تسجيلها أو التدخل. مع الوكلاء الفرعيين داخل استدعاء واحد، تكون تلك الآلية مبهمة. ترى المدخلات والمخرجات النهائية، وليس التفرعات بينهما. لتدفقات العمل التي تحتاج إلى سجل تدقيق، لا يزال المنسق اليدوي هو الأفضل.

أنماط فشل مختلفة. يفشل الوكيل الواحد بطرق يمكنك عادة تتبعها. يفشل النموذج الذي يشغل وكلاء فرعيين داخليين بطرق يصعب إسنادها. هل انحرف أحد الوكلاء الفرعيين عن المسار؟ هل أسقطت خطوة الدمج شيئًا؟ لن تتمكن دائمًا من معرفة ذلك من الخارج، وهذا أمر مهم عند تصحيح أخطاء وكيل قيد الإنتاج.

هذا هو نفس التوتر الذي يسري في كل نظام متعدد الوكلاء، ولكنه انتقل إلى مكان آخر. لمعرفة كيف يصوغه المنسقون المخصصون، يستعرض Fugu Ultra مقابل Fable 5 مقابل Mythos نموذجًا تم بناؤه صراحة كمنسق متعدد الوكلاء، وهو تباين مفيد لدمج OpenAI للفكرة داخل نموذج واحد.

زمن الاستجابة والتكلفة: لماذا وضع Ultra ليس مجانيًا

يعمل الوكلاء الفرعيون بالتوازي، لذا بالنسبة للمهمة الصحيحة، يمكن لوضع Ultra أن ينجز العمل أسرع من وكيل واحد يعمل ببطء عبر كل خطوة بالتسلسل. هذا هو الهدف من "تسريع العمل المعقد".

جانب التكلفة هو ما تحتاج أن تكون صريحًا بشأنه. Sol هو المستوى الرائد، وسعر مخرجاته 30 دولارًا لكل مليون توكن، بينما المدخلات بسعر 5 دولارات لكل مليون (Terra وLuna هما مستويات أرخص في نفس العائلة). الآن تخيل وضع Ultra يولد عدة وكلاء فرعيين، كل منهم يولد منطقه الخاص وتوكنات المخرجات. تتراكم هذه التوكنات عبر كل وكيل فرعي، لذا فإن استدعاء Ultra واحد يمكن أن يستهلك أكثر بكثير من استدعاء Max واحد لنفس المطالبة. يوازن وضع Ultra التوكنات مقابل السرعة والعمق في العمل الصعب والقابل للموازاة. إذا كانت مهمتك لا تنقسم إلى أجزاء مستقلة، فأنت تدفع مقابل وكلاء فرعيين ينتظرون بعضهم البعض أو يكررون الجهد. هذه هي حالة الإفراط.

يخفف التخزين المؤقت للمطالبات الفاتورة. يدعم GPT-5.6 نقاط توقف التخزين المؤقت الصريحة بحد أدنى لعمر التخزين المؤقت يبلغ 30 دقيقة. تُحاسب عمليات كتابة ذاكرة التخزين المؤقت بمعدل 1.25 ضعف سعر الإدخال غير المخزن مؤقتًا، وتحصل عمليات قراءة ذاكرة التخزين المؤقت على خصم 90% للإدخال المخزن مؤقتًا. إذا تشارك وكلاؤك الفرعيون سياقًا مشتركًا كبيرًا، مثل مطالبة نظام كبيرة أو قاعدة كود ثابتة، فإن تخزينها مؤقتًا مرة واحدة وقراءتها بسعر رخيص عبر الاستدعاءات يوفر الكثير من المال. إنه لا يغير تكلفة توكن الإخراج، وهي النقطة التي يستهلك فيها وضع Ultra أكثر.

متى يساعد وضع Ultra ومتى يكون إفراطًا

استخدم وضع Ultra عندما تنقسم المهمة إلى أجزاء مستقلة تستفيد من العمل المتوازي، وحيث تبرر الدقة التكلفة. فكر في تغيير كبير في قاعدة الكود يمس العديد من الملفات في وقت واحد، أو مهمة بحثية تتفرع عبر عدة مصادر، أو وظيفة معقدة تعتمد على الوكلاء مع فروع متوازية. هذه هي الوظائف التي تضع OpenAI Sol في موقعها من أجلها، بما في ذلك أعمال البرمجة والعلوم.

تجنب وضع Ultra عندما تكون المهمة متسلسلة، أو صغيرة، أو حساسة لزمن الاستجابة بميزانية محدودة: إجابة قصيرة، تعديل ملف واحد، تصنيف سريع. بالنسبة لهذه المهام، ينشئ وضع Ultra وكلاء فرعيين ليس لديهم ما يوازونه، ويكون جهد التفكير الأقصى أو حتى الجهد الافتراضي هو الخيار الأكثر صراحة.

إليك طريقة مباشرة للتقرير. إذا لم تتمكن من تقسيم المهمة على عدة مقاولين بشريين يعملون في نفس الوقت، فربما لا يمكن للنموذج الحصول على قيمة كبيرة من الوكلاء الفرعيين أيضًا. العمل المتسلسل يظل متسلسلًا بغض النظر عن عدد الوكلاء الذين تستخدمهم.

كيف يتناسب هذا مع الاتجاه الأوسع للوكلاء المتعددين

ليست OpenAI هي الأولى التي توصلت إلى فكرة أن عدة وكلاء منسقين يتفوقون على وكيل واحد. لقد أطلقت مختبرات أخرى نماذج وأطر عمل حيث يقوم المتحكم بتفويض المهام للمتخصصين ويجمع النتائج معًا. الجديد هو طريقة التقديم: تقدم OpenAI هذا النمط كوضع في نموذج واحد بدلاً من نظام منفصل تقوم بتجميعه.

هذا رهان حول مسار بناء الوكلاء. إذا أصبح التنسيق داخل النموذج جيدًا بما فيه الكفاية، فإن العديد من طبقات التنسيق اليدوية ستصبح زائدة عن الحاجة للحالات الشائعة. إذا ظل غامضًا ويصعب تصحيح أخطائه، فستستمر الفرق التي تحتاج إلى التحكم في بناء أنظمتها الخاصة. يمكن أن يكون كلاهما صحيحًا في وقت واحد، حيث يتعامل وضع Ultra مع الحالات السهلة، بينما تمتلك التنسيقات المخصصة تلك التي تحتاج إلى سجل تدقيق. يتعمق تحليل معايير GPT-5.6 Sol في ما إذا كانت الأرقام تدعم ادعاءات التنسيق، وتتمحور حول القرار الوحيد الذي يمكنك اتخاذه الآن: الانتظار أو المضي قدمًا.

ما يمكنك فعله اليوم

لا يمكنك تشغيل وضع Ultra، لذا فإن الخطوة العملية هي بناء واختبار نمط التنسيق على نموذج يمكنك استدعاؤه. النماذج الرائدة المتاحة حاليًا، مثل Claude Mythos 5، وClaude Fable 5، وGPT-5.5، وGemini 3.5 Pro، وGLM-5.2، وFugu Ultra، كلها تعرض نقاط نهاية دردشة متوافقة مع OpenAI أو قياسية يمكنك توصيلها اليوم.

هنا يأتي دور Apidog. يمكنك إرسال طلبات إلى أي من واجهات برمجة تطبيقات هذه النماذج، وتعيين معلمات مثل "جهد التفكير" حيث يدعمها النموذج، والتأكد من الاستجابات، وحفظ الاستدعاءات كسيناريوهات اختبار قابلة لإعادة الاستخدام. عندما تحصل على وصول لمعاينة GPT-5.6، يكون الإعداد نفسه جاهزًا: قم بتبديل نقطة النهاية ومعرف النموذج، وستختبر Sol في اليوم الذي تحصل فيه على الوصول. أنت لا تختبر Sol اليوم، لأنه لا يمكن لأحد خارج الشركاء المعتمدين القيام بذلك. أنت تجهز عدة الاختبار الخاصة بك حتى لا يكون اليوم الأول هرجًا ومرجًا.

لقطة شاشة لـ Apidog تعرض واجهة برمجة تطبيقات ومجموعات طلبات لتتبع نماذج الواجهة الأمامية.

الخلاصة

وضع Ultra هو الجزء الأكثر تطلعًا للمستقبل من إطلاق GPT-5.6: تنسيق كان يعيش في الكود الخاص بك، انتقل الآن إلى استدعاء نموذج واحد. وهو أيضًا جزء لا يمكنك لمسه بعد، وعندما تتمكن من ذلك، لن يكون رخيصًا، لذا فإن الانضباط يكمن في مطابقة الإعداد مع العمل. استخدم "أقصى" عندما يحتاج عامل واحد إلى التفكير بجدية أكبر. الجأ إلى وضع Ultra فقط عندما تنقسم المهمة حقًا إلى أجزاء متوازية تستحق فاتورة التوكنات.

هل تريد أن تكون عدة الاختبار الخاصة بك جاهزة لليوم الذي يفتح فيه Sol؟ قم بتنزيل Apidog وابدأ في اختبار واجهات برمجة تطبيقات النماذج الرائدة التي يمكنك استدعاءها اليوم.

زر

ممارسة تصميم API في Apidog

اكتشف طريقة أسهل لبناء واستخدام واجهات برمجة التطبيقات