لاستدعاء واجهة برمجة تطبيقات GPT-6.1 Sol، أرسل طلب POST إلى https://api.openai.com/v1/responses مع "model": "gpt-6.1-sol" ومفتاحك كرمز Bearer. يُسعّر بنفس سعر GPT-6 Sol، وهو 2 دولار للمدخل و 10 دولارات للمخرج لكل مليون رمز مميز، وينخفض سعر المدخل المخزن مؤقتًا من 0.20 دولار إلى 0.10 دولار. الترحيل من gpt-6-sol هو في الغالب تبديل لسلسلة نصية. التغيير الجوهري هو مستوى الجهد: GPT-6.1 Sol لا يقبل none أو minimal، لذا تنتقل هذه الطلبات إلى low، جنبًا إلى جنب مع أي تعليمات برمجية اعتمدت على none.
أطلقت OpenAI نموذج GPT-6.1 Sol في DevDay بتاريخ 29 سبتمبر 2026. يغطي ملخص DevDay 2026 الإطلاقات الأخرى، ويغطي ما هو GPT-6.1 Sol المعايير بشكل معمق. يغطي هذا الدليل طلبك الأول، ومستوى الجهد الذي تبدأ به، وكل تغييرات الترحيل، وطبقات Batch و Flex و Fast، وتشغيل اختبار التراجع (regression run) جنبًا إلى جنب لكلا معرّفي النموذج في Apidog قبل تحويل حركة المرور الإنتاجية.
GPT-6 Sol مقابل GPT-6.1 Sol: ما الذي تغير في واجهة برمجة التطبيقات (API)
معظم المواصفات متطابقة. إليك الفرق الكامل من صفحة نموذج GPT-6.1 Sol، وصفحة نموذج GPT-6 Sol وإرشادات الترحيل إلى GPT-6 من OpenAI:
gpt-6-sol |
gpt-6.1-sol |
الإجراء المطلوب | |
|---|---|---|---|
| المدخل / المخرج لكل مليون (قياسي) | $2 / $10 | $2 / $10 | لا شيء |
| المدخل المخزن مؤقتًا لكل مليون | $0.20 | $0.10 | أعد حسابات التخزين المؤقت |
| كتابات التخزين المؤقت لكل مليون | $2.50 | $2.50 | لا شيء |
| نافذة السياق / الحد الأقصى للمدخل / الحد الأقصى للمخرج | 1,050,000 / 922,000 / 128,000 | 1,050,000 / 922,000 / 128,000 | لا شيء |
| تاريخ قطع المعرفة | 20 أبريل 2026 | 30 أبريل 2026 | أعد فحص التقييمات الحساسة للتواريخ |
reasoning.effort |
none, low, medium (افتراضي), high, xhigh, max |
low, medium (افتراضي), high, xhigh, max |
انقل none إلى low وأعد التقييم |
| استدعاء الدالة في Chat Completions | فقط مع reasoning_effort: "none" |
غير مدعوم | انقل استدعاءات الأدوات إلى Responses |
| نقاط النهاية | Chat Completions, Responses, Batch | نفسه | لا شيء |
| حدود المعدل | المستوى 1: 500 طلب في الدقيقة (RPM) / 500 ألف رمز في الدقيقة (TPM)؛ المستوى 5: 15,000 طلب في الدقيقة (RPM) / 40 مليون رمز في الدقيقة (TPM) | نفسه | لا شيء |
توجه صفحة GPT-6 Sol الآن القراء إلى GPT-6.1 Sol باعتباره "نموذج Sol الأحدث".
أرسل طلبك الأول إلى GPT-6.1 Sol
قم بتصدير مفتاحك كـ OPENAI_API_KEY، ثم استدعِ واجهة برمجة تطبيقات Responses:
curl https://api.openai.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{
"model": "gpt-6.1-sol",
"reasoning": {"effort": "medium"},
"input": "List three ways a webhook retry policy can create duplicate orders. One line each."
}'
تقرأ حزمة SDK الخاصة بلغة بايثون نفس متغير البيئة:
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-6.1-sol",
reasoning={"effort": "medium"},
input="List three ways a webhook retry policy can create duplicate orders. One line each.",
)
print(response.output_text)
print(response.usage)
أربعة أجزاء من الاستجابة مهمة:
statusيكونcompletedعند النجاح. إذا استنفد النموذج ميزانية الإخراج، فستحصل علىincompleteمع تعيينincomplete_details.reasonإلىmax_output_tokens، وأحيانًا قبل أي نص مرئي. يقترح دليل الاستدلال حجز 25,000 رمز مميز على الأقل للاستدلال والإخراج أثناء التجربة.outputهي مصفوفة. الإجابة هي العنصر الذي يحملtype: "message"، والذي يحتوي محتواه علىoutput_text. اقرأه حسب النوع، وليس حسب الفهرس.usage.output_tokensيتضمن رموز الاستدلال، ويتم محاسبتها بسعر الإخراج. يوضحusage.output_tokens_details.reasoning_tokensعددها.usage.input_tokens_detailsيبلغ عنcached_tokensوcache_write_tokens. هذا هو المكان الذي يظهر فيه التخزين المؤقت الأقل تكلفة.
استخدم واجهة برمجة تطبيقات Responses لأي شيء يتضمن أدوات؛ يدعم GPT-6.1 Sol ميزة Chat Completions فقط للطلبات التي لا تتضمن أدوات. يغطي دليل واجهة برمجة تطبيقات Responses شكل الطلب بمزيد من التفصيل.
اختر مستوى جهد الاستدلال
الجهد هو مقياسك الرئيسي للتكلفة والجودة، و medium هو الافتراضي عند إغفاله. يربط دليل اختيار النماذج من OpenAI مستوى medium بـ "الأعمال الفنية المعقدة والنتائج المنسقة التي تتوقع مراجعتها،" ومستوى xhigh بالنتائج النهائية عالية الجودة والقرارات المبنية على أدلة متضاربة. يضيف منشور إطلاق OpenAI النتائج حسب الإعداد. هذه المعايير مبلغ عنها من قبل OpenAI، ويقتبس الجدول الفروقات التي ذكرتها OpenAI في نصها:
| الجهد | ابدأ هنا من أجل | ما أبلغت عنه OpenAI لـ GPT-6.1 Sol |
|---|---|---|
low |
الدردشة، الاستخراج، التصنيف، أي شيء قمت بتشغيله على none |
في المحادثات التي أبلغ عنها المستخدمون، تنخفض الاستجابات التي تحتوي على خطأ واقعي من 11.4% (GPT-6 Sol) إلى 7.7% |
medium (افتراضي) |
أتمتة الوكلاء وسير عمل استدعاء الأدوات | AutomationBench 1.0.6: +2.2 نقطة مئوية أكثر من Claude Opus 5.5 بتكلفة تعادل حوالي الثلث؛ +4.8 نقطة مئوية أكثر من GPT-6 Sol بنفس الإعداد |
high |
تصحيح الأخطاء الصعبة والتخطيط العميق | لا يوجد ادعاء خاص بالإعداد |
xhigh |
نتائج نهائية مصقولة وعمليات تشغيل غير متزامنة طويلة | لا يوجد ادعاء خاص بالإعداد |
max |
استخدام الكمبيوتر ومهام العلوم الصعبة | OSWorld 2.0: +7 نقطة مئوية أكثر من GPT-6 Sol عند الحد الأقصى بتكلفة أقل من النصف. Terminal-Bench Science 0.1: 5.47 دولار لكل مهمة، مقابل 23.21 دولار لـ Opus 5.5 و 23.80 دولار لـ GPT-6 Astra |
تحذيران. مجموعة الحقائق هي محادثات تم الإبلاغ عنها مسبقًا لوجود أخطاء فيها، وليست حركة مرور عادية. وفي Terminal-Bench Science، لا يزال GPT-6 Astra يحقق أعلى الدرجات (68.1%)، لذا توصي OpenAI بـ Astra للأعمال العلمية الأكثر صعوبة.
بالنسبة للمكالمات الحساسة للتأخير التي استخدمت none، ابدأ من low وقم بالقياس. يصف دليل الاستدلال low بأنه استدلال فعال "مع زيادة متواضعة في التأخير". لتغيير الجهد في منتصف المحادثة دون كسر ذاكرة التخزين المؤقت للموجه، أضف عنصر إدخال configuration_update بدلاً من تغيير reasoning.effort على مستوى الطلب.
الترحيل من gpt-6-sol: أربعة تغييرات في التعليمات البرمجية
- **استبدل معرّف النموذج.** استبدل
gpt-6-solبـgpt-6.1-sol، واحتفظ به في ملف التكوين أو متغير بيئة لتسهيل عملية التراجع بتعديل واحد. - **أعد تعيين
noneوminimal.** إرشادات OpenAI: استخدمlowبدلاً منnone، وابدأminimalمنlowوقارن على المهام التمثيلية. في GPT-6 Astra، الذي يفتقر أيضًا إلىnone، يؤدي إرساله إلى إرجاع HTTP 400، لذا قم بإصلاح ذلك قبل نقل حركة المرور. - **أزل معاملات أخذ العينات.** عندما لا يكون الجهد
none، قم بإزالةtemperature،top_pوtop_logprobs(وlogprobsفي Chat Completions). تحتاج التعليمات البرمجية التي جمعتtemperatureمعnoneفي GPT-6 Sol إلى هذا التغيير. - **انقل استدعاءات أدوات Chat Completions إلى Responses.** سمح GPT-6 Sol باستدعاء الدالة في Chat Completions فقط عند
reasoning_effort: "none". لا يوجد مكافئ لهذا المزيج في 6.1 Sol.
ثم أعد تشغيل أي شيء يعتمد على الحداثة: ينتقل تاريخ القطع من 20 أبريل إلى 30 أبريل 2026. إذا انتقلت إلى Sol من Astra، يغطي دليل الترحيل من Astra إلى Sol هذه الخطوة السابقة.
تسعير Batch، Flex، Fast والمدخلات المخزنة مؤقتًا
تحافظ كل طبقة على شكل GPT-6 Sol، مع خفض عمود المدخلات المخزنة مؤقتًا إلى النصف. الأسعار لكل مليون رمز مميز مأخوذة من صفحة تسعير واجهة برمجة التطبيقات. تضيف صفحة النموذج أن الموجه الذي يزيد عن 272 ألف رمز إدخال يتم محاسبته بضعف سعر الإدخال والتخزين المؤقت و 1.5 ضعف سعر الإخراج للطلب الكامل، وهي نفس القاعدة التي يستخدمها GPT-6 Sol:
| الطبقة | المدخل | المدخل المخزن مؤقتًا | كتابات التخزين المؤقت | المخرج |
|---|---|---|---|---|
| قياسي | $2.00 | $0.10 | $2.50 | $10.00 |
| دفعة | $1.00 | $0.05 | $1.25 | $5.00 |
| مرن | $1.00 | $0.05 | $1.25 | $5.00 |
| سريع | $4.00 | $0.20 | $5.00 | $20.00 |
| قياسي، موجه أكثر من 272 ألف رمز إدخال | $4.00 | $0.20 | $5.00 | $15.00 |
Flex هو service_tier: "flex" لكل طلب. Fast هو service_tier: "fast"، مع قبول "priority" كاسم مستعار. الوضع السريع غير متاح مع إقامة البيانات في الاتحاد الأوروبي. الوضع فائق السرعة (Ultrafast) لـ GPT-6.1 Sol "قادم قريبًا" وهو متاح على نطاق واسع فقط لـ GPT-6 Astra اليوم؛ انظر وضع OpenAI فائق السرعة. بالنسبة للوظائف الليلية، يستعرض دليل OpenAI Batch API تشغيل دفعة.
التخزين المؤقت هو المكان الذي يوفر فيه التحديث المال. تكلفة القراءات هي 0.05 ضعف سعر الإدخال على 6.1 Sol مقابل 0.1 ضعف على GPT-6 Sol، وتكلفة الكتابات هي 1.25 ضعف على كليهما، وفقًا لدليل التخزين المؤقت للموجهات. لنأخذ موجه نظام مكون من 50,000 رمز مميز يُعاد استخدامه عبر 1,000 طلب. تكلف كتابة واحدة 0.125 دولار على أي من النموذجين؛ وتكلف 999 قراءة 9.99 دولار على GPT-6 Sol و 5.00 دولارات على GPT-6.1 Sol. الحد الأدنى للبادئة القابلة للتخزين المؤقت هو 1,024 رمزًا مرئيًا، وتبقى البادئة المخزنة مؤقتًا مؤهلة لمدة 30 دقيقة على الأقل بعد آخر كتابة أو إعادة استخدام لها. لاستراتيجية نقطة التوقف، انظر التخزين المؤقت للموجه في GPT-6.
اختبر التبديل في Apidog
لا تحول الإنتاج بناءً على الأسعار المعلنة فقط. أرسل نفس الطلب المحفوظ إلى كلا المعرّفين وقارن ما يعود. في Apidog:
- قم بإنشاء بيئة تحتوي على
OPENAI_API_KEY(مخزنة كسرّ)،MODEL_IDمضبوطة علىgpt-6-sol، وEFFORTمضبوطة علىmedium. - أنشئ طلب
POST https://api.openai.com/v1/responsesمع ترويسةAuthorization: Bearer {{OPENAI_API_KEY}}وهذا النص، ثم احفظه:
{
"model": "{{MODEL_ID}}",
"reasoning": {"effort": "{{EFFORT}}"},
"max_output_tokens": 25000,
"input": "Return a JSON object with keys risk and fix for this policy: retry any 5xx three times with no idempotency key."
}
- أضف تأكيدات: HTTP 200،
$.statusيساويcompleted،$.output[*].typeيحتوي علىmessage،$.usage.output_tokensأكبر من 0، و$.usage.output_tokens_details.reasoning_tokensموجود. ثم تحقق من شكل الإخراج الذي تعتمد عليه التعليمات البرمجية الخاصة بك، مثل JSON صالح مع المفاتيح التي تقوم بتحليلها. - أضف برنامجًا نصيًا للمعالجة اللاحقة يحول
usageإلى دولارات، باستخدام تقسيم المدخلات من دليل التخزين المؤقت للموجهات الخاص بـ OpenAI:
const u = pm.response.json().usage;
const d = u.input_tokens_details || {};
const cached = d.cached_tokens || 0;
const writes = d.cache_write_tokens || 0;
const model = pm.environment.get("MODEL_ID");
const cachedRate = model === "gpt-6.1-sol" ? 0.10 : 0.20;
const cost = ((u.input_tokens - cached - writes) * 2 + cached * cachedRate
+ writes * 2.5 + u.output_tokens * 10) / 1e6;
console.log(model, "cost per call $", cost.toFixed(5));
- أرسله، اضبط
MODEL_IDعلىgpt-6.1-sol، ثم أرسله مرة أخرى. قارنreasoning_tokens،output_tokens، الإجابة والتكلفة المسجلة. إذا كنت تعيد تعيين منnone، قم بتشغيل الأساس علىnoneوالمرشح علىlow.
ثم انقل الطلب وعددًا قليلاً من الموجهات الحقيقية إلى سيناريو اختبار وقم بتشغيل الزوج من Apidog CLI في CI. --env-var يتجاوز متغيرًا لمرة تشغيل واحدة، لذا يغطي سيناريو واحد كلا النموذجين:
npm install -g apidog-cli
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
--env-var "MODEL_ID=gpt-6-sol" -r cli,junit
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
--env-var "MODEL_ID=gpt-6.1-sol" -r cli,junit
فشل التأكيد يؤدي إلى فشل المهمة، وتقدم تقارير JUnit كلا عمليتي التشغيل جنبًا إلى جنب. للتأكيدات على المخرجات التي تختلف من عملية تشغيل إلى أخرى، انظر اختبار وكلاء الذكاء الاصطناعي غير الحتميين.
الأسئلة الشائعة
- **هل GPT-6.1 Sol أغلى من GPT-6 Sol؟** لا. كلاهما مسعر بـ 2 دولار للمدخل و 10 دولارات للمخرج لكل مليون رمز مميز. المدخل المخزن مؤقتًا لـ GPT-6.1 Sol هو 0.10 دولار مقابل 0.20 دولار، لذا تصبح أعباء العمل التي تعتمد بكثرة على التخزين المؤقت أرخص.
- **ماذا أفعل بـ
reasoning.effort: "none"؟** لا يدعم GPT-6.1 Solnoneولاminimal. قم بتعيين كليهما إلىlow، وأزلtemperatureوtop_p، وأعد تشغيل تقييماتك قبل التبديل. - **هل يمكنني استخدام GPT-6.1 Sol مع Chat Completions؟** نعم، للطلبات التي لا تحتوي على أدوات. استدعاء الأدوات يتطلب واجهة برمجة تطبيقات Responses.
- **هل هناك طبقة مجانية لواجهة برمجة تطبيقات GPT-6.1 Sol؟** لا. يتم احتساب تكلفة استدعاءات واجهة برمجة التطبيقات لكل رمز مميز بدءًا من الطلب الأول. يغطي هل GPT-6.1 Sol مجاني؟ أرخص الطرق.
الخطوة التالية
احفظ الطلب الأول، وقم بتشغيله على gpt-6-sol بمستوى جهدك الحالي، ثم على gpt-6.1-sol، وقارن usage والمخرج على موجه من حركة المرور الخاصة بك. قم بتنزيل Apidog للاحتفاظ بكلا عمليتي التشغيل كتأكيدات يمكنك إعادة تشغيلها في CI. هل تفكر في Anthropic بدلاً من ذلك؟ انظر GPT-6.1 Sol مقابل Claude Sonnet 5.5.
