بارامتر الجهد لكلود أوبوس 5: مقايضة التكلفة مقابل القدرة

شرح معلمة جهد كلود أوبوس 5: جميع المستويات الخمسة، ولماذا تكون قيمتها الافتراضية عالية، وما الذي غيرته عملية إعادة المعايرة، وتفاعلها مع max_tokens، وخطأ 400 عند تعطيل التفكير.

INEZA Felin-Michel

INEZA Felin-Michel

25 يوليو 2026

بارامتر الجهد لكلود أوبوس 5: مقايضة التكلفة مقابل القدرة

Apidog للمؤسسات

النشر على الخوادم المحلية

SSO و RBAC

متوافق مع SOC 2

استكشف Apidog للمؤسسات

كل مقال رئيسي عن إطلاق Claude Opus 5 في 24 يوليو 2026 ذكر الميزة نفسها. وصفتها مجلة Fortune بأنها طريقة للتبديل بين التكلفة والقدرة. أشارت إليها CNBC وبلومبرج وتك كرانش جميعها. لم يقل أي منها ما هي، وما هي المستويات، وماذا يحدث عند تغيير أحدها، أو ماذا تفعل لفاتورتك.

إنها معلمة طلب تسمى effort، ولها خمسة مستويات في Opus 5، والقيمة الافتراضية لها هي high. هذه هي الميزة بأكملها. ما يجعلها تستحق مقالاً هو أن Anthropic أعادت معايرة المستويات لهذا النموذج، مما يعني أن الإعدادات التي قمت بضبطها على Opus 4.8 أصبحت الآن خاطئة، ومجموعة محددة من الإعدادات تُرجع خطأ 400 سيظهر في الكثير من سجلات الترحيل هذا الأسبوع.

💡
إذا كنت ترغب في تجربة المستويات مقابل نقطة نهاية حقيقية أثناء القراءة، فإن Apidog طريقة مباشرة لإطلاق نفس الطلب بخمسة إعدادات مختلفة ومقارنة النتائج.
زر

ما هي معلمة الجهد (effort) بالفعل

توجد معلمة الجهد (effort) في الكائن output_config في طلب Messages API:

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "output_config": { "effort": "high" },
  "messages": [
    { "role": "user", "content": "Refactor this module and explain the tradeoffs." }
  ]
}

إنها تتحكم في مقدار التفكير الداخلي الذي يقوم به النموذج قبل الإجابة. يقوم Opus 5 بتشغيل التفكير التكيفي افتراضيًا، والجهد هو القرص الذي يحدد مدى سخاء إنفاق ميزانية التفكير هذه. الجهد الأعلى يعني المزيد من الرموز المميزة للتفكير، وتكلفة أعلى، ووقت استجابة أطول. الجهد الأقل يعني أقل من هذه الثلاثة جميعًا.

تعرض واجهات المستخدم نفس الفكرة كمحدد جهد بدلاً من حقل JSON خام، وهذا هو مصدر الإطار الصحفي للتبديل بين التكلفة والقدرة. يكمن تحته هذه المعلمة. إذا قمت بالبناء على واجهة برمجة التطبيقات، فإن المعلمة هي الشيء الذي تتحكم فيه فعليًا، وهذا ما يتحدث عنه بقية هذا المقال. الشكل الكامل للطلب موجود في دليلنا التفصيلي لواجهة برمجة تطبيقات Opus 5، والمرجع الخاص بالمعلمات موجود في نظرة عامة على نماذج Anthropic.

شيء واحد ليس جهدًا: التحكم في الإسهاب. يوضح دليل توجيه Anthropic لـ Opus 5 أن تقليل الجهد يقلل من التفكير، وليس طول الاستجابة المرئية. يكتب Opus 5 بالفعل إجابات افتراضية أطول ومخرجات أطول من Opus 4.8. إذا كنت تريد مخرجًا أقصر، فاطلب مخرجًا أقصر في التوجيه. التخفيض إلى low لن يفعل ذلك لك.

المستويات الخمسة

المستوى ماذا يفعل الملاءمة النموذجية
low (منخفض) أدنى حد من التفكير قبل الإجابة تصنيف بكميات كبيرة، استخراج، توجيه، ملخصات قصيرة
medium (متوسط) تفكير معتدل الأسئلة والأجوبة بناءً على سياق مسترجع، تعديلات ملف واحد، تحويلات منظمة
high (مرتفع) افتراضي. تفكير كبير الأعمال ذات الأغراض العامة عندما لم تقم بقياس أي شيء بعد
xhigh (مرتفع جدًا) تفكير ممتد الترميز والحلقات العاملة. نقطة البداية الموصى بها من Anthropic لكليهما
max (أقصى) الحد الأقصى لميزانية التفكير المشكلات الصعبة أحادية اللقطة حيث تكلف الإجابة الخاطئة أكثر من الرموز

هناك أمران في هذا الجدول يسهل التغاضي عنهما.

القيمة الافتراضية هي high، وليست low ولا xhigh. إذا أرسلت طلبًا بدون output_config على الإطلاق، فستحصل على high. وهذا مهم للتنبؤ بالتكاليف: الطلب الذي لم يتم المساس به على Opus 5 يقوم بعمل تفكير حقيقي ويتم محاسبتك عليه، بينما نفس الطلب الذي لم يتم المساس به على Opus 4.8 لم يفعل أي تفكير على الإطلاق. هذا التغيير هو أحد التغييرين الكبيرين في ترحيل Opus 4.8 إلى Opus 5، وهو الأكثر احتمالاً لمفاجأة فريق التمويل.

و xhigh هي التوصية للترميز والعمليات العاملة، وليست max. تحدد Anthropic xhigh كنقطة بداية لأعباء العمل هذه. يوجد max فوقها، لكن البدء بها يعني الدفع مقابل مساحة علوية قد لا تتمكن من قياس فائدة منها. ابدأ بـ xhigh، ثم انزل.

ما الذي غيرته إعادة المعايرة

هذا هو الجزء الذي يجعل نقل الإعدادات عبر النماذج فكرة سيئة.

أعادت Anthropic معايرة معنى كل مستوى جهد في Opus 5. لا يصف التسمية medium في Opus 5 نفس كمية التفكير التي وصفتها medium في Opus 4.8. توجيه Anthropic هو إجراء مسح جديد للجهد على Opus 5 بدلاً من نقل تكوين 4.8 الخاص بك.

النتيجة العملية أكثر إثارة للاهتمام من التحذير. في نماذج Opus السابقة، كانت المستويات low و medium نظرية في الغالب للعمل الجاد: كانت رخيصة، وكانت أيضًا أسوأ بشكل ملحوظ، لذلك كانت الفرق تضع كل شيء عند high أو أعلى وتدفع ثمنه. في Opus 5، المستويات الأقل أقوى بشكل ملحوظ مما كانت عليه، وهذه هي المرة الأولى التي تكون فيها low و medium قابلة للاستخدام حقًا في نموذج من فئة Opus للمهام الإنتاجية.

هذه هي رافعة التكلفة الفعلية في الإطلاق، وهي التي ضغطها التغطية الصحفية في كلمة "تبديل". يكلف Opus 5 مبلغ 5 دولارات لكل مليون رمز إدخال و 25 دولارًا لكل مليون رمز إخراج، وهو نفس تكلفة Opus 4.8. تقع رموز التفكير على جانب الإخراج من تلك الفاتورة. لذا، فإن الفرق بين تشغيل خط أنابيب التصنيف عند high وتشغيله عند low ليس خطأ تقريبيًا، بل هو جزء كبير من إنفاقك على الإخراج في عبء عمل لم يكن التفكير الإضافي فيه يشتري لك الدقة في المقام الأول. يحتوي تحليل تسعير Opus 5 الخاص بنا على بطاقة الأسعار الكاملة، بما في ذلك خصم الدفعة بنسبة 50٪ والحد الأدنى لذاكرة التخزين المؤقت 512 رمزًا، وكلاهما يتراكم مع إعداد جهد أقل.

إذا كنت تبحث عن توفير عبر كل Claude بدلاً من نقطة نهاية واحدة، فإن الروافع في خفض فاتورة Claude API الخاصة بك تنطبق هنا أيضًا، مع إضافة الجهد الآن إلى القائمة.

تفاعل xhigh و max مع max_tokens

تحدد max_tokens رموز التفكير بالإضافة إلى رموز الاستجابة معًا. إنها سقف صارم على جانب الإخراج بأكمله للطلب، وليس فقط النص المرئي.

ارفع الجهد وترفع مقدار هذا السقف الذي ينفقه النموذج على التفكير قبل أن يبدأ في الكتابة. ادفع الجهد إلى xhigh أو max مع ترك max_tokens عند قيمة قمت بتحديدها لنموذج لم يكن يفكر، ويمكن للنموذج أن يحرق ميزانية التفكير ويقتطع قبل أن ينهي الإجابة. تحصل على استجابة مقطوعة دون أي خطأ واضح في الطلب.

الحل هو إعطائه مساحة. توجيه Anthropic هو البدء بـ max_tokens: 64000 عندما تقوم بتشغيل xhigh أو max على Opus 5:

{
  "model": "claude-opus-5",
  "max_tokens": 64000,
  "output_config": { "effort": "xhigh" },
  "messages": [
    { "role": "user", "content": "Fix the failing integration test and explain the root cause." }
  ]
}

قيمة max_tokens عالية هي سقف، وليست عملية شراء. يتم محاسبتك على الرموز المنتجة فعليًا، لذا فإن تعيين 64000 لا يعني الدفع مقابل 64000. إنه يعني أن النموذج لا يُجبر على التوقف في منتصف التفكير.

خطأ 400 الذي لم يكتب عنه أحد بعد

هذا سيتسبب في إنشاء تذاكر دعم.

تعطيل التفكير وطلب جهد عالٍ هي تعليمات متناقضة، ويرفض Opus 5 هذا الجمع تمامًا. إرسال thinking: {type: "disabled"} جنبًا إلى جنب مع الجهد xhigh أو max يعيد خطأ 400، يتم فرضه لكل طلب:

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "thinking": { "type": "disabled" },
  "output_config": { "effort": "xhigh" }
}

هذا الطلب يفشل. تعطيل التفكير يحد من الجهد عند high. لذا فإن المجموعات الصالحة هي:

مسار الترحيل الذي ينتج هذا الخطأ يمكن التنبؤ به: فريق ينقل thinking: {type: "disabled"} من تكوين Opus 4.8 حيث كان غير ضار، ثم يرفع الجهد بشكل منفصل إلى xhigh لأن هذه هي التوصية للترميز. كلا التعديلين يبدوان معقولين بمعزل عن بعضهما. معًا ينتجان خطأ 400.

نصيحة Anthropic نفسها هي عدم تعطيل التفكير في Opus 5 على الإطلاق. مع إيقاف التفكير، تظهر حالتا فشل عرضيًا: يكتب النموذج استدعاءات الأدوات كنص عادي لا يتم تنفيذه أبدًا، وتتسرب علامات XML الداخلية إلى الإخراج المرئي. في حلقة عاملة، يؤدي النص المتسرب بعد ذلك إلى تسميم الأدوار اللاحقة. الطريقة الموصى بها للتحكم في التكلفة في Opus 5 هي مستوى جهد أقل، وليس تعطيل التفكير. نتعمق في كلا التحفتين في دليل توجيه Opus 5.

كيفية إجراء مسح للجهد على تقييماتك الخاصة

تطلب منك Anthropic إعادة المسح. إليك إجراء يمكن القيام به في فترة ما بعد الظهر.

1. تجميد مجموعة مهام. اسحب 30 إلى 50 توجيهًا حقيقيًا من سجلات الإنتاج، وليس أمثلة اصطناعية. قم بتضمين الحالات الصعبة التي تقلق بشأنها بالفعل. تختفي اختلافات الجهد في المهام السهلة، وهذا هو بالضبط سبب عدم إخبار مجموعة عينات نظيفة لك بأي شيء.

2. اكتب معيار النجاح قبل أن تنظر إلى أي مخرج. الاختبارات خضراء، JSON يتحقق من صحته مقابل مخطط، الحقل المستخرج يتطابق مع الحقيقة الأساسية، المقيم البشري يقول نعم أو لا. إذا كان معيارك هو شعور، فإن مسحك ينتج شعورًا.

3. قم بتشغيل كل توجيه على كل مستوى. خمسة مستويات مضروبة في 40 توجيهًا تساوي 200 مكالمة. في Opus 5، هذا رخيص بما يكفي لعدم التفكير فيه، ويمكنك إرساله عبر Batch API بنصف السعر نظرًا لعدم حساسية أي شيء لوقت الاستجابة.

4. التقاط ثلاثة أرقام لكل تشغيل، وليس رقم واحد: النجاح أو الفشل، usage.output_tokens، وزمن الاستجابة (wall-clock latency). كتلة usage في الاستجابة هي المكان الذي توجد فيه إشارة التكلفة الحقيقية، لأنها تحسب رموز التفكير التي كنت ستخمنها بخلاف ذلك.

5. اختر أرخص مستوى يفي بمتطلباتك، ثم أكد ذلك على مجموعة اختبار لم يتم الضبط عليها. تميل الفرق التي تتجاهل مجموعة الاختبار إلى شحن إعداد مناسب لـ 40 توجيهًا محددًا.

6. أعد تشغيله على النموذج التالي. السبب الكامل لوجود هذا المسح هو أن المستويات تمت إعادة معايرتها بين 4.8 و 5. افترض أن ذلك سيحدث مرة أخرى.

مقارنة المستويات جنبًا إلى جنب في Apidog

الجزء الميكانيكي من المسح هو إرسال نص طلب واحد خمس مرات مع تغيير حقل واحد ومقارنة ما يعود. هذا يتطلب الكثير من النسخ واللصق باستخدام curl، وهذا هو الجزء الذي يجعل Apidog أنيقًا.

إعداد يعمل:

  1. أنشئ طلبًا مقابل نقطة نهاية Anthropic Messages وقم بتخزين مفتاحك كمتغير بيئة بدلاً من لصقه في النص. تبقى المفاتيح بعيدة عن أي شيء تشاركه مع الفريق.
  2. احفظ الطلب العامل في مجموعة، ثم كررها خمس مرات وقم بتغيير output_config.effort فقط في كل نسخة.
  3. افحص كائن usage في كل استجابة حتى تتمكن من رؤية رموز الإخراج لكل مستوى مباشرةً، بالإضافة إلى cache_read_input_tokens عندما تتحقق مما إذا كان التخزين المؤقت الخاص بك يعمل.
  4. قم بتشغيل البث واقرأ أحداث SSE إذا كنت ترغب في معرفة أين يذهب زمن الاستجابة فعليًا عند xhigh مقابل low.
  5. أضف تأكيدًا بأن stop_reason موجود وليس max_tokens، بحيث يفشل الرد المقتطع من xhigh بصوت عالٍ في مجموعتك بدلاً من أن يبدو وكأنه إجابة قصيرة بهدوء.

هذا التأكيد الأخير هو الأهم الذي يجب إعداده أولاً، لأن الاقتطاع عند الجهد العالي هو الأكثر احتمالًا أن يحدث خطأ. قم بتنزيل Apidog إذا كنت ترغب في بناء مجموعة المقارنات أثناء القراءة. لا شيء هنا يتطلب ذلك؛ إنه فقط أفضل من صيانة خمسة نصوص برمجية (shell scripts).

السقف الصادق

الجهد يجعل تشغيل Opus 5 أرخص بكفاءة. لكنه لا يجعل Opus 5 قمة مكدس Claude.

أرقام إطلاق Anthropic لـ Opus 5 قوية: أكثر من ضعف نتيجة Opus 4.8 في Frontier-Bench v0.1، تقريبًا 3 أضعاف النموذج الأفضل التالي في ARC-AGI 3، وفي نطاق 0.5% من Fable 5 في CursorBench 3.2 بنصف السعر. كل هذه الأرقام هي أرقام يديرها البائع، ونشرتها Anthropic، ولم يتم إعادة إنتاجها بشكل مستقل حتى 25 يوليو 2026. تعامل معها كادعاءات بمصدر، وليست قياسات محايدة، واطلع على تحليل مقاييس Opus 5 الخاص بنا للاطلاع على التحذيرات المتعلقة بكل منها.

فوق Opus 5، لا يزال Fable 5 هو النموذج الأكثر قدرة الذي أطلقته Anthropic على نطاق واسع، بسعر 10 دولارات لكل مليون رمز إدخال و 50 دولارًا لكل مليون رمز إخراج. ولا يزال Opus 5 يتخلف عن Mythos 5 في استغلال الأمن السيبراني وأبحاث البيولوجيا الذاتية، وهو ما ذكرته Anthropic مباشرة. تشغيل Opus 5 عند max لا يسد أي من هذه الفجوات. الملخص الصادق هو قدرة على مستوى الحدود بسعر نصف سعر الحدود، مع وجود سقف محدد فوقه. ما إذا كان فرق السعر يستحق ذلك لعملك هو السؤال الذي ندرسه في Opus 5 مقابل Fable 5.

زر

الأسئلة الشائعة

ما هو مستوى الجهد الافتراضي في Claude Opus 5؟ high. الطلب الذي لا يحتوي على حقل output_config يعمل بجهد high مع تشغيل التفكير التكيفي.

ما هي مستويات الجهد الخمسة؟ low، medium، high، xhigh، و max. توصي Anthropic بالبدء بـ xhigh لأعمال الترميز والوكلاء، ثم النزول من هناك بناءً على تقييماتك الخاصة.

لماذا يعيد طلبي خطأ 400 عندما أضبط الجهد على xhigh؟ على الأرجح لأنك أرسلت أيضًا thinking: {type: "disabled"}. تعطيل التفكير يحد من الجهد عند high، ويتم رفض هذا الدمج لكل طلب. إما أن تزيل كتلة تعطيل التفكير أو تخفض الجهد إلى high أو أقل.

هل يمكنني إعادة استخدام إعدادات الجهد الخاصة بي من Opus 4.8 في Opus 5؟ لا. تمت إعادة معايرة المستويات، لذا فإن نفس التسمية تعني كمية مختلفة من التفكير. تطلب منك Anthropic إجراء مسح جديد. القائمة الكاملة للتغييرات موجودة في دليل الترحيل.

هل يؤدي تقليل الجهد إلى جعل الاستجابات أقصر؟ لا. الجهد يتحكم في التفكير، وليس الطول المرئي، والاستجابات الافتراضية لـ Opus 5 أطول من استجابات Opus 4.8. اطلب الإيجاز صراحةً إذا كنت تريد مخرجًا أقصر.

ما هي قيمة max_tokens التي يجب أن أستخدمها عند xhigh أو max؟ ابدأ بـ 64000. max_tokens يحدد سقفًا للتفكير والاستجابة معًا، لذا فإن ميزانية معدة لنموذج لا يفكر ستؤدي إلى اقتطاع. يتم محاسبتك فقط على الرموز المنتجة، لذا فإن السقف العالي لا يكلف شيئًا بحد ذاته.

للاطلاع على ورقة المواصفات الكاملة، ومصفوفة التوفر، وسياق التسعير حول كل هذا، ابدأ بـ ما هو Claude Opus 5.

ممارسة تصميم API في Apidog

اكتشف طريقة أسهل لبناء واستخدام واجهات برمجة التطبيقات