كيف تستخدم GPT-6.1 Sol API؟

دليل واجهة برمجة تطبيقات GPT-6.1 Sol: طلبك الأول لـ gpt-6.1-sol، مستويات الجهد، تسعير الدفعة/المرن/السريع، والتغييرات الأربعة للترحيل من gpt-6-sol.

INEZA Felin-Michel

INEZA Felin-Michel

30 سبتمبر 2026

كيف تستخدم GPT-6.1 Sol API؟

Apidog للمؤسسات

النشر على الخوادم المحلية

SSO و RBAC

متوافق مع SOC 2

استكشف Apidog للمؤسسات

لاستدعاء واجهة برمجة تطبيقات GPT-6.1 Sol، أرسل طلب POST إلى https://api.openai.com/v1/responses مع "model": "gpt-6.1-sol" ومفتاحك كرمز Bearer. يُسعّر بنفس سعر GPT-6 Sol، وهو 2 دولار للمدخل و 10 دولارات للمخرج لكل مليون رمز مميز، وينخفض سعر المدخل المخزن مؤقتًا من 0.20 دولار إلى 0.10 دولار. الترحيل من gpt-6-sol هو في الغالب تبديل لسلسلة نصية. التغيير الجوهري هو مستوى الجهد: GPT-6.1 Sol لا يقبل none أو minimal، لذا تنتقل هذه الطلبات إلى low، جنبًا إلى جنب مع أي تعليمات برمجية اعتمدت على none.

أطلقت OpenAI نموذج GPT-6.1 Sol في DevDay بتاريخ 29 سبتمبر 2026. يغطي ملخص DevDay 2026 الإطلاقات الأخرى، ويغطي ما هو GPT-6.1 Sol المعايير بشكل معمق. يغطي هذا الدليل طلبك الأول، ومستوى الجهد الذي تبدأ به، وكل تغييرات الترحيل، وطبقات Batch و Flex و Fast، وتشغيل اختبار التراجع (regression run) جنبًا إلى جنب لكلا معرّفي النموذج في Apidog قبل تحويل حركة المرور الإنتاجية.

زر

GPT-6 Sol مقابل GPT-6.1 Sol: ما الذي تغير في واجهة برمجة التطبيقات (API)

معظم المواصفات متطابقة. إليك الفرق الكامل من صفحة نموذج GPT-6.1 Sol، وصفحة نموذج GPT-6 Sol وإرشادات الترحيل إلى GPT-6 من OpenAI:

gpt-6-sol gpt-6.1-sol الإجراء المطلوب
المدخل / المخرج لكل مليون (قياسي) $2 / $10 $2 / $10 لا شيء
المدخل المخزن مؤقتًا لكل مليون $0.20 $0.10 أعد حسابات التخزين المؤقت
كتابات التخزين المؤقت لكل مليون $2.50 $2.50 لا شيء
نافذة السياق / الحد الأقصى للمدخل / الحد الأقصى للمخرج 1,050,000 / 922,000 / 128,000 1,050,000 / 922,000 / 128,000 لا شيء
تاريخ قطع المعرفة 20 أبريل 2026 30 أبريل 2026 أعد فحص التقييمات الحساسة للتواريخ
reasoning.effort none, low, medium (افتراضي), high, xhigh, max low, medium (افتراضي), high, xhigh, max انقل none إلى low وأعد التقييم
استدعاء الدالة في Chat Completions فقط مع reasoning_effort: "none" غير مدعوم انقل استدعاءات الأدوات إلى Responses
نقاط النهاية Chat Completions, Responses, Batch نفسه لا شيء
حدود المعدل المستوى 1: 500 طلب في الدقيقة (RPM) / 500 ألف رمز في الدقيقة (TPM)؛ المستوى 5: 15,000 طلب في الدقيقة (RPM) / 40 مليون رمز في الدقيقة (TPM) نفسه لا شيء

توجه صفحة GPT-6 Sol الآن القراء إلى GPT-6.1 Sol باعتباره "نموذج Sol الأحدث".

أرسل طلبك الأول إلى GPT-6.1 Sol

قم بتصدير مفتاحك كـ OPENAI_API_KEY، ثم استدعِ واجهة برمجة تطبيقات Responses:

curl https://api.openai.com/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{
    "model": "gpt-6.1-sol",
    "reasoning": {"effort": "medium"},
    "input": "List three ways a webhook retry policy can create duplicate orders. One line each."
  }'

تقرأ حزمة SDK الخاصة بلغة بايثون نفس متغير البيئة:

from openai import OpenAI

client = OpenAI()
response = client.responses.create(
    model="gpt-6.1-sol",
    reasoning={"effort": "medium"},
    input="List three ways a webhook retry policy can create duplicate orders. One line each.",
)
print(response.output_text)
print(response.usage)

أربعة أجزاء من الاستجابة مهمة:

استخدم واجهة برمجة تطبيقات Responses لأي شيء يتضمن أدوات؛ يدعم GPT-6.1 Sol ميزة Chat Completions فقط للطلبات التي لا تتضمن أدوات. يغطي دليل واجهة برمجة تطبيقات Responses شكل الطلب بمزيد من التفصيل.

اختر مستوى جهد الاستدلال

الجهد هو مقياسك الرئيسي للتكلفة والجودة، و medium هو الافتراضي عند إغفاله. يربط دليل اختيار النماذج من OpenAI مستوى medium بـ "الأعمال الفنية المعقدة والنتائج المنسقة التي تتوقع مراجعتها،" ومستوى xhigh بالنتائج النهائية عالية الجودة والقرارات المبنية على أدلة متضاربة. يضيف منشور إطلاق OpenAI النتائج حسب الإعداد. هذه المعايير مبلغ عنها من قبل OpenAI، ويقتبس الجدول الفروقات التي ذكرتها OpenAI في نصها:

الجهد ابدأ هنا من أجل ما أبلغت عنه OpenAI لـ GPT-6.1 Sol
low الدردشة، الاستخراج، التصنيف، أي شيء قمت بتشغيله على none في المحادثات التي أبلغ عنها المستخدمون، تنخفض الاستجابات التي تحتوي على خطأ واقعي من 11.4% (GPT-6 Sol) إلى 7.7%
medium (افتراضي) أتمتة الوكلاء وسير عمل استدعاء الأدوات AutomationBench 1.0.6: +2.2 نقطة مئوية أكثر من Claude Opus 5.5 بتكلفة تعادل حوالي الثلث؛ +4.8 نقطة مئوية أكثر من GPT-6 Sol بنفس الإعداد
high تصحيح الأخطاء الصعبة والتخطيط العميق لا يوجد ادعاء خاص بالإعداد
xhigh نتائج نهائية مصقولة وعمليات تشغيل غير متزامنة طويلة لا يوجد ادعاء خاص بالإعداد
max استخدام الكمبيوتر ومهام العلوم الصعبة OSWorld 2.0: +7 نقطة مئوية أكثر من GPT-6 Sol عند الحد الأقصى بتكلفة أقل من النصف. Terminal-Bench Science 0.1: 5.47 دولار لكل مهمة، مقابل 23.21 دولار لـ Opus 5.5 و 23.80 دولار لـ GPT-6 Astra

تحذيران. مجموعة الحقائق هي محادثات تم الإبلاغ عنها مسبقًا لوجود أخطاء فيها، وليست حركة مرور عادية. وفي Terminal-Bench Science، لا يزال GPT-6 Astra يحقق أعلى الدرجات (68.1%)، لذا توصي OpenAI بـ Astra للأعمال العلمية الأكثر صعوبة.

بالنسبة للمكالمات الحساسة للتأخير التي استخدمت none، ابدأ من low وقم بالقياس. يصف دليل الاستدلال low بأنه استدلال فعال "مع زيادة متواضعة في التأخير". لتغيير الجهد في منتصف المحادثة دون كسر ذاكرة التخزين المؤقت للموجه، أضف عنصر إدخال configuration_update بدلاً من تغيير reasoning.effort على مستوى الطلب.

الترحيل من gpt-6-sol: أربعة تغييرات في التعليمات البرمجية

  1. **استبدل معرّف النموذج.** استبدل gpt-6-sol بـ gpt-6.1-sol، واحتفظ به في ملف التكوين أو متغير بيئة لتسهيل عملية التراجع بتعديل واحد.
  2. **أعد تعيين none و minimal.** إرشادات OpenAI: استخدم low بدلاً من none، وابدأ minimal من low وقارن على المهام التمثيلية. في GPT-6 Astra، الذي يفتقر أيضًا إلى none، يؤدي إرساله إلى إرجاع HTTP 400، لذا قم بإصلاح ذلك قبل نقل حركة المرور.
  3. **أزل معاملات أخذ العينات.** عندما لا يكون الجهد none، قم بإزالة temperature، top_p و top_logprobs (و logprobs في Chat Completions). تحتاج التعليمات البرمجية التي جمعت temperature مع none في GPT-6 Sol إلى هذا التغيير.
  4. **انقل استدعاءات أدوات Chat Completions إلى Responses.** سمح GPT-6 Sol باستدعاء الدالة في Chat Completions فقط عند reasoning_effort: "none". لا يوجد مكافئ لهذا المزيج في 6.1 Sol.

ثم أعد تشغيل أي شيء يعتمد على الحداثة: ينتقل تاريخ القطع من 20 أبريل إلى 30 أبريل 2026. إذا انتقلت إلى Sol من Astra، يغطي دليل الترحيل من Astra إلى Sol هذه الخطوة السابقة.

تسعير Batch، Flex، Fast والمدخلات المخزنة مؤقتًا

تحافظ كل طبقة على شكل GPT-6 Sol، مع خفض عمود المدخلات المخزنة مؤقتًا إلى النصف. الأسعار لكل مليون رمز مميز مأخوذة من صفحة تسعير واجهة برمجة التطبيقات. تضيف صفحة النموذج أن الموجه الذي يزيد عن 272 ألف رمز إدخال يتم محاسبته بضعف سعر الإدخال والتخزين المؤقت و 1.5 ضعف سعر الإخراج للطلب الكامل، وهي نفس القاعدة التي يستخدمها GPT-6 Sol:

الطبقة المدخل المدخل المخزن مؤقتًا كتابات التخزين المؤقت المخرج
قياسي $2.00 $0.10 $2.50 $10.00
دفعة $1.00 $0.05 $1.25 $5.00
مرن $1.00 $0.05 $1.25 $5.00
سريع $4.00 $0.20 $5.00 $20.00
قياسي، موجه أكثر من 272 ألف رمز إدخال $4.00 $0.20 $5.00 $15.00

Flex هو service_tier: "flex" لكل طلب. Fast هو service_tier: "fast"، مع قبول "priority" كاسم مستعار. الوضع السريع غير متاح مع إقامة البيانات في الاتحاد الأوروبي. الوضع فائق السرعة (Ultrafast) لـ GPT-6.1 Sol "قادم قريبًا" وهو متاح على نطاق واسع فقط لـ GPT-6 Astra اليوم؛ انظر وضع OpenAI فائق السرعة. بالنسبة للوظائف الليلية، يستعرض دليل OpenAI Batch API تشغيل دفعة.

التخزين المؤقت هو المكان الذي يوفر فيه التحديث المال. تكلفة القراءات هي 0.05 ضعف سعر الإدخال على 6.1 Sol مقابل 0.1 ضعف على GPT-6 Sol، وتكلفة الكتابات هي 1.25 ضعف على كليهما، وفقًا لدليل التخزين المؤقت للموجهات. لنأخذ موجه نظام مكون من 50,000 رمز مميز يُعاد استخدامه عبر 1,000 طلب. تكلف كتابة واحدة 0.125 دولار على أي من النموذجين؛ وتكلف 999 قراءة 9.99 دولار على GPT-6 Sol و 5.00 دولارات على GPT-6.1 Sol. الحد الأدنى للبادئة القابلة للتخزين المؤقت هو 1,024 رمزًا مرئيًا، وتبقى البادئة المخزنة مؤقتًا مؤهلة لمدة 30 دقيقة على الأقل بعد آخر كتابة أو إعادة استخدام لها. لاستراتيجية نقطة التوقف، انظر التخزين المؤقت للموجه في GPT-6.

اختبر التبديل في Apidog

لا تحول الإنتاج بناءً على الأسعار المعلنة فقط. أرسل نفس الطلب المحفوظ إلى كلا المعرّفين وقارن ما يعود. في Apidog:

  1. قم بإنشاء بيئة تحتوي على OPENAI_API_KEY (مخزنة كسرّ)، MODEL_ID مضبوطة على gpt-6-sol، و EFFORT مضبوطة على medium.
  2. أنشئ طلب POST https://api.openai.com/v1/responses مع ترويسة Authorization: Bearer {{OPENAI_API_KEY}} وهذا النص، ثم احفظه:
{
  "model": "{{MODEL_ID}}",
  "reasoning": {"effort": "{{EFFORT}}"},
  "max_output_tokens": 25000,
  "input": "Return a JSON object with keys risk and fix for this policy: retry any 5xx three times with no idempotency key."
}
  1. أضف تأكيدات: HTTP 200، $.status يساوي completed، $.output[*].type يحتوي على message، $.usage.output_tokens أكبر من 0، و $.usage.output_tokens_details.reasoning_tokens موجود. ثم تحقق من شكل الإخراج الذي تعتمد عليه التعليمات البرمجية الخاصة بك، مثل JSON صالح مع المفاتيح التي تقوم بتحليلها.
  2. أضف برنامجًا نصيًا للمعالجة اللاحقة يحول usage إلى دولارات، باستخدام تقسيم المدخلات من دليل التخزين المؤقت للموجهات الخاص بـ OpenAI:
const u = pm.response.json().usage;
const d = u.input_tokens_details || {};
const cached = d.cached_tokens || 0;
const writes = d.cache_write_tokens || 0;
const model = pm.environment.get("MODEL_ID");
const cachedRate = model === "gpt-6.1-sol" ? 0.10 : 0.20;
const cost = ((u.input_tokens - cached - writes) * 2 + cached * cachedRate
  + writes * 2.5 + u.output_tokens * 10) / 1e6;
console.log(model, "cost per call $", cost.toFixed(5));
  1. أرسله، اضبط MODEL_ID على gpt-6.1-sol، ثم أرسله مرة أخرى. قارن reasoning_tokens، output_tokens، الإجابة والتكلفة المسجلة. إذا كنت تعيد تعيين من none، قم بتشغيل الأساس على none والمرشح على low.

ثم انقل الطلب وعددًا قليلاً من الموجهات الحقيقية إلى سيناريو اختبار وقم بتشغيل الزوج من Apidog CLI في CI. --env-var يتجاوز متغيرًا لمرة تشغيل واحدة، لذا يغطي سيناريو واحد كلا النموذجين:

npm install -g apidog-cli
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
  --env-var "MODEL_ID=gpt-6-sol" -r cli,junit
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
  --env-var "MODEL_ID=gpt-6.1-sol" -r cli,junit

فشل التأكيد يؤدي إلى فشل المهمة، وتقدم تقارير JUnit كلا عمليتي التشغيل جنبًا إلى جنب. للتأكيدات على المخرجات التي تختلف من عملية تشغيل إلى أخرى، انظر اختبار وكلاء الذكاء الاصطناعي غير الحتميين.

الأسئلة الشائعة

الخطوة التالية

احفظ الطلب الأول، وقم بتشغيله على gpt-6-sol بمستوى جهدك الحالي، ثم على gpt-6.1-sol، وقارن usage والمخرج على موجه من حركة المرور الخاصة بك. قم بتنزيل Apidog للاحتفاظ بكلا عمليتي التشغيل كتأكيدات يمكنك إعادة تشغيلها في CI. هل تفكر في Anthropic بدلاً من ذلك؟ انظر GPT-6.1 Sol مقابل Claude Sonnet 5.5.

ممارسة تصميم API في Apidog

اكتشف طريقة أسهل لبناء واستخدام واجهات برمجة التطبيقات