تخبرك معظم أدلة الترحيل بما يتعطل في التعليمات البرمجية الخاصة بك. هذا الدليل يدور حول ما يتعطل في الأوامر (Prompts) الخاصة بك.
تم إطلاق Claude Opus 5 في 24 يوليو 2026، وقامت Anthropic بشحن دليل أوامر مخصص إلى جانبه. يوثق هذا الدليل شيئًا يستحق الاهتمام: العديد من التعليمات التي جعلت Opus 4.8 أفضل تجعل Opus 5 أسوأ. ليس أسوأ بشكل طفيف. بل أسوأ بشكل ملحوظ من حيث التكلفة، وأكثر تفصيلاً بشكل ملحوظ، وفي إحدى الحالات معطلة تمامًا.
السبب بسيط. يقوم Opus 5 بالفعل، من تلقاء نفسه، بالعديد من الأشياء التي كنت تضطر إلى طلبها. عندما يطلب أمرك القديم ذلك على أي حال، فإن التعليمات تتضاعف مع السلوك الذي يمتلكه النموذج بالفعل. تحصل على مضاعفة لعدد مرات التحقق، وليس مضاعفة للدقة.
يستعرض هذا الدليل كل تحول سلوكي موثق مع مقتطف أمر (Prompt) يمكنك نسخه ولصقه في أمر النظام الخاص بك اليوم. ويغطي أيضًا نمطي الفشل اللذين يظهران عند تعطيل التفكير، وهو المكان الوحيد الذي يمكن أن ينتج فيه أمر Opus 5 مخرجًا يبدو جيدًا ويفسد حلقة الوكيل بصمت. إذا كنت لا تزال تعمل على التغييرات على مستوى التعليمات البرمجية، فإن دليل ترحيل Opus 4.8 إلى Opus 5 يغطي هذه التغييرات بشكل منفصل. وإذا كنت ترغب في مشاهدة هذه السلوكيات تتغير في حمولات الطلبات والاستجابات الحقيقية، فإن Apidog هي طريقة مباشرة لإرسال نفس الأمر بإعدادات مختلفة ومقارنة النتائج.
الملخص في سطر واحد
يتحقق Opus 5 أكثر، ويكتب أكثر، ويفوض أكثر، ويوضح نفسه أكثر مما فعله Opus 4.8. تم ضبط أمر Opus 4.8 الخاص بك لدفع النموذج نحو هذه السلوكيات. الآن يدفعها إلى ما بعدها.
لذا فإن العمل هو عملية طرح. أنت في الغالب تحذف التعليمات، لا تضيفها. والإضافات التي تقوم بها هي قيود: كن أقصر، ابق ضمن النطاق، لا تستدعي مساعدين.
1. احذف تعليمات التحقق الخاصة بك
هذه هي النقطة الأهم، وهي سبب العنوان.
تذكر Anthropic أن Opus 5 يتحقق من عمله الخاص دون طلب. يعيد قراءة ما كتبه، ويتحقق من حساباته، ويعيد تشغيل اختبار، ويبحث عن الحالات الهامشية التي لم تذكرها. كان هذا هو السلوك الدقيق الذي أدخله الجميع يدويًا في Opus 4.8 باستخدام أسطر مثل "تحقق جيدًا من عملك قبل الرد" أو "تحقق من كل خطوة".
إذا استمريت في استخدام هذه الأسطر، ستحصل على تحقق مفرط. يقوم النموذج بتشغيل عمليات تحقق كان سيقوم بها على أي حال، بالإضافة إلى تلك التي طلبتها، وتدفع مقابل كل رمز (token) منها. في عمليات الوكيل الطويلة، هذا يمثل فاتورة حقيقية، وليس خطأ تقريب.
الحل هو الحذف. ابحث في أوامر النظام الخاصة بك عن هذه الأنماط وأزلها:
Double-check your work before responding.
Verify each step before moving to the next one.
Review your answer for errors, then revise it.
Check your reasoning carefully.
Make sure the output is correct before returning it.
إذا كانت لديك خطوة ذات مخاطر عالية حقًا حيث تريد عملية تحقق صريحة، قصرها على تلك الخطوة بدلاً من جعلها قاعدة عامة:
Do not add general verification passes; you already verify by default.
The only exception: after writing the migration SQL, run it against the
schema dump once and report any mismatch. Do not re-verify anything else.
هذا الشكل مهم. تعليمات "تحقق من كل شيء" العالمية في Opus 5 هي مضاعف للتكلفة. استثناء واحد محدد النطاق هو تحكم.
إذا كنت تتبع إنفاق API عبر هذا الترحيل، فإن أدوات التخزين المؤقت والدفعات في توزيع أسعار Opus 5 تتراكم مع هذه الأداة، ويغطي دليلنا لخفض فاتورة Claude API الأدوات العامة.
2. اطلب الإيجاز صراحة، لأن الجهد لن يفي بالغرض
تكون الاستجابات الافتراضية لـ Opus 5 أطول من استجابات Opus 4.8. وكذلك المخرجات المكتوبة: التقارير، الملخصات، وثائق التصميم، وملفات README التي ينتجها عندما تطلب مستندًا.
هذا هو الجزء الذي يربك الناس. خفض معلمة effort لا يحل هذه المشكلة. تتحكم Effort في مدى تفكير النموذج. ولا تتحكم في كمية الكتابة التي ينجزها النموذج. إذا خفضت من xhigh إلى medium، فإنك تقلل من رموز التفكير بينما تظل الاستجابة المرئية بنفس الطول تقريبًا. إذا افترضت أن الجهد كان مؤشرًا للإسهاب، فلن تتحرك فاتورتك بالطريقة التي توقعتها. يغطي دليل معلمة الجهد في Opus 5 ما يغيره كل مستوى فعليًا.
الطول مشكلة في التوجيه (Prompting)، لذا حلها في الأمر (Prompt). كن محددًا بشأن الحد الأقصى بدلاً من قول "كن موجزًا"، وهو ما تفسره النماذج بسخاء:
Response format: at most 150 words unless I ask for more.
No preamble, no restatement of my question, no summary at the end.
Lead with the answer, then the reasoning if it is needed.
بالنسبة للمخرجات المكتوبة، ضع حدًا على الناتج وسمِّ ما يجب حذفه:
Write the migration doc at 800 words maximum.
Include: the breaking changes, the fix for each, and a rollback step.
Exclude: background on the old system, a glossary, and a conclusion section.
If a section would exceed its share, cut examples before cutting steps.
للعمل الذي يتضمن الكثير من التعليمات البرمجية، يكون القيد المعادل حول التعليقات، وليس التعليمات البرمجية:
Return the diff and nothing else.
No explanation of what you changed unless the change is non-obvious,
in which case one sentence above the hunk.
3. حدد تفويض الوكلاء الفرعيين
يفوض Opus 5 إلى الوكلاء الفرعيين بسهولة أكبر مما فعله Opus 4.8. بالنظر إلى مهمة متعددة الأجزاء ونظام يدعم الاستنساخ، فإنه سيتوسع.
غالبًا ما يكون هذا هو الخيار الصحيح. إنه أيضًا قرار تكلفة يتخذه النموذج نيابة عنك، ويحمل كل وكيل فرعي سياقه الخاص وفاتورة الرموز الخاصة به. لأحمال العمل الحساسة للتكلفة أو حساسة لزمن الاستجابة، ضع رقمًا عليها بدلاً من ترك الأمر لتقدير النموذج:
Do not spawn subagents for this task. Handle it in this conversation.
أو، عندما يكون التوسع مفيدًا حقًا ولكن يجب أن يكون له حدود:
You may delegate to at most 2 subagents, and only for independent
file-level work that can run in parallel.
Do research, planning, and final synthesis yourself in this thread.
النمط الذي يجب تجنبه هو التفويض لذاته: وكيل فرعي تم استدعاؤه لقراءة ملف واحد، أو لاتخاذ قرار كان لدى السلسلة الرئيسية السياق لاتخاذه بالفعل. إذا كنت تبني مع وكلاء فرعيين عن قصد، فإن دليلنا حول إنشاء وكلاء فرعيين لـ Claude Code يغطي جانب التحكم في تحديد نطاقهم.
4. قيد النطاق صراحة في المهام الضيقة
يوسع Opus 5 نطاق المهمة. اطلب منه إصلاح اختبار فاشل وقد يقوم أيضًا بإعادة هيكلة المساعد الذي يستدعيه الاختبار، وتحديث توقيع النوع، وإضافة حالتي اختبار إضافيتين. اطلب منه إعادة تسمية متغير وقد يقوم بترتيب الدالة المحيطة.
في بعض الأحيان تكون هذه ميزة. في مهمة ضيقة ومحددة، لا تكون كذلك: إعادة هيكلة غير مطلوبة تعني فرقًا أكبر للمراجع لقراءته ونطاق تأثير أكبر لتغيير كان من المفترض أن يكون سطرًا واحدًا.
حدد الحدود كحدود، وسمِّ ما هو خارج الحدود:
Scope: change only the retry-count constant in src/client/http.ts.
Do not refactor surrounding code, do not rename anything, do not add
tests, do not update docs. If you believe another change is required,
stop and tell me instead of making it.
هذه الفقرة الأخيرة هي النصف المفيد. بدونها، لا يملك النموذج طريقة معتمدة لإثارة مشكلة حقيقية، لذا فإنه إما يقوم بالتغيير على أي حال أو يتجاهل الملاحظة. معها، تحصل على اهتمام مؤشر وتغيير غير متغير.
5. توقع المزيد من سرد التصحيح، وقم بإيقاف تشغيله إذا لم تكن ترغب به
يسرد Opus 5 تصحيحاته أكثر مما فعل Opus 4.8. عندما يغير رأيه في منتصف الاستجابة، يخبرك: يشير إلى أن نهجًا سابقًا كان خاطئًا، ويشرح السبب، ويصف التبديل.
للعمل التفاعلي، هذا مفيد. أما لخط أنابيب حيث تغذي الاستجابة محللًا (parser) أو واجهة مستخدم (UI) أو نموذجًا آخر، فإن هذا السرد يعتبر ضجيجًا يقع في حقل من المفترض أن يحمل إجابة.
التعليمات قصيرة:
Do not narrate corrections or changes of approach.
Return only the final answer. If you revised your thinking, that
revision belongs in your reasoning, not in the response.
إذا قمت بتوجيه الاستجابات إلى تخزين منظم، فقم بإقران ذلك بمخرجات منظمة بحيث يتم فرض الشكل بدلاً من طلبه.
أنماط الفشل عند تعطيل التفكير
كل ما سبق هو مشكلة ضبط. هذا الجزء هو مشكلة صحة.
توثق Anthropic عيبين يظهران أحيانًا في Opus 5 عندما يتم تعطيل التفكير عبر thinking: {type: "disabled"}. كلاهما يستحق المعرفة قبل نشر وكيل.
استدعاءات الأدوات مكتوبة كنص عادي. يصدر النموذج شيئًا يبدو كاستدعاء أداة، ولكنه كنص في جسم الاستجابة بدلاً من كتل tool_use المهيكلة. لا شيء يُنفذ. في محادثة أحادية الدور، ستلاحظ ذلك. في حلقة وكيل، غالبًا لا تلاحظ: لا ترى الحلقة أي استدعاء أداة، لذا لا تتخذ أي إجراء، ويبقى النص المتسرب في سجل المحادثة. ثم تقرأ الأدوار اللاحقة هذا النص كما لو كان قد حدث استدعاء. يتفاقم الفشل عبر الأدوار، وبحلول الوقت الذي يبدو فيه الإخراج خاطئًا، يكون السبب قد حدث قبل عدة أدوار.
علامات XML داخلية في الإخراج المرئي. تظهر علامات مثل <thinking> في الاستجابة التي يراها المستخدم. سيئة من الناحية الجمالية بحد ذاتها، وأسوأ إذا قمت بعرض الاستجابات كـ HTML أو تحليلها للحصول على بنية.
الجزء غير البديهي: تسمية العلامات في أمرك (prompt) يجعل التسرب أسوأ، وليس أفضل. تعليمات مثل "لا تخرج علامات <thinking> أبدًا" تضع تسلسل الرموز في السياق وتزيد من احتمالية ظهورها. لا تكتب هذه التعليمات.
التخفيف الموصى به من قبل Anthropic ليس أمرًا على الإطلاق. إنه للحفاظ على التفكير ممكّنًا والتحكم في التكلفة بمستوى جهد أقل بدلاً من ذلك:
{
"model": "claude-opus-5",
"max_tokens": 4096,
"output_config": { "effort": "low" },
"messages": [
{ "role": "user", "content": "..." }
]
}
هذا يمنحك الطرف الأرخص من النطاق دون عيوب التفكير المعطل. كما يتجنب فخًا ذا صلة: في Opus 5، يؤدي الجمع بين thinking: {type: "disabled"} مع الجهد xhigh أو max إلى إرجاع خطأ 400، لأن تعطيل التفكير محدد بجهد high. لاحظ أيضًا أن التفكير أصبح ممكّنًا افتراضيًا الآن، لذا فإن الطلب الذي يحذف حقل thinking ببساطة يعمل بالتفكير التكيفي بدلاً من بدونه، كما كان سيحدث في Opus 4.8.
إذا كان لديك متطلب صارم لتعطيل التفكير، فأضف فحصًا دفاعيًا في حلقتك بدلاً من تعليمات الأوامر (prompt): ارفض أي دور للمساعد يحتوي نصه على سلسلة نصية تشبه استدعاء لم يتم تنفيذه قبل إضافتها إلى السجل. افشل بصوت عالٍ بدلاً من السماح باستدعاء وهمي في السجل.
اختبر التغييرات بدلاً من التخمين
من الصعب تقييم تغييرات الأوامر (Prompts) بقراءتها. تظهر السلوكيات هنا (طول الاستجابة، عدد مرات التحقق، عدد الوكلاء الفرعيين) كأعداد رموز وبنية حمولة، مما يعني أن الطريقة الصادقة للتحقق من عملك هي إرسال الطلبات والمقارنة.

يمكن إعداد ذلك بسهولة في Apidog، وهي منصة متكاملة لتطوير واختبار واجهات برمجة التطبيقات (API):
- قم ببناء طلب واحد مقابل نقطة نهاية Anthropic Messages باستخدام
"model": "claude-opus-5"، وقم بتخزين مفتاح API الخاص بك كمتغير بيئة بدلاً من لصقه في النص الأساسي. - احفظ أمر نظام Opus 4.8 القديم وإصدار Opus 5 المقلص الخاص بك كطلبين محفوظين مقابل نفس المدخلات.
- قارن كتلة
usageفي كل استجابة. تخبرك رموز الإخراج ما إذا كان قيد الإيجاز قد تحقق؛ وتخبرك رموز الإدخال وحقول التخزين المؤقت ما إذا كانت تعديلات الأمر (prompt) الخاصة بك قد أدت إلى كسر بادئة التخزين المؤقت. - كرر الطلب عبر مستويات الجهد لترى بنفسك أن رموز التفكير تنخفض بينما يبقى الطول المرئي ثابتًا.
- افحص الاستجابة المتدفقة لتأكيد وصول استدعاءات الأدوات ككتل
tool_useمنظمة وليس كنص.
الخطوة الخامسة هي التي تلتقط فشل استدعاء الأداة كنص عادي قبل أن يصل إلى الإنتاج. قم بتنزيل Apidog إذا كنت ترغب في تشغيل هذه الجوانب جنبًا إلى جنب، واطلع على دليل API الخاص بـ Opus 5 لمعرفة شكل الطلب الكامل.
السقف الحقيقي
تجدر الإشارة بوضوح، بما أن أدلة الأوامر (prompting guides) تميل إلى القراءة وكأن النموذج هو الأخير الذي ستحتاجه على الإطلاق: Opus 5 ليس قمة مكدس Claude. يحتفظ Fable 5 بتصنيف "الأكثر قدرة والأكثر انتشارًا"، ولا يزال Opus 5 يتخلف عن Mythos 5 في استغلال الأمن السيبراني وأبحاث البيولوجيا الذاتية. تقول Anthropic كلا الأمرين في منشور إطلاقها. الإطار الدقيق هو قدرة من فئة الحدود القصوى بنصف سعر الحدود القصوى، مع سقف مسمى فوقها.
ادعاءات معايير الإطلاق (Frontier-Bench, ARC-AGI 3, OSWorld 2.0, CursorBench) هي جميعها أرقام Anthropic الخاصة ولم يتم التحقق منها بشكل مستقل حتى 25 يوليو 2026. تعامل معها على أنها أرقام مقدمة من البائع، وقم بإجراء تقييماتك الخاصة على الأوامر (prompts) التي تستخدمها بالفعل.
تجميعها معًا
يبدو أمر نظام Opus 5 المقلص لمهمة وكيل حساسة للتكلفة تقريبًا هكذا:
Do not add verification passes; you verify by default.
Responses: 150 words maximum, no preamble, no closing summary.
Do not spawn subagents. Handle this in one thread.
Stay strictly within the task I state. If another change seems
required, stop and tell me rather than making it.
Do not narrate corrections or changes of approach.
ستة أسطر، خمسة منها قيود ولا يطلب أي منها من النموذج بذل جهد أكبر. هذا هو التحول. في Opus 4.8، كنت توجه لرفع الحد الأدنى. في Opus 5، أنت توجه لوضع سقف.
ابدأ من هناك، ثم قم بإجراء مسح للجهد على تقييماتك الخاصة بدلاً من نقل إعدادات 4.8 الخاصة بك، حيث تم إعادة معايرة المستويات. لميكانيكا المعلمات، راجع دليل معلمة الجهد، لسير عمل جانب المحرر، راجع استخدام Opus 5 في Claude Code، ولصورة النموذج الكاملة، ابدأ من ما هو Claude Opus 5. يحتوي نظرة عامة على نماذج Anthropic على جدول المواصفات الحالي.
الأسئلة الشائعة
هل يجب علي حقًا حذف "راجع عملك مرتين" من أوامري؟ نعم. يقول دليل أوامر Anthropic أن Opus 5 يتحقق دون طلب، وتؤدي تعليمات التحقق المنقولة إلى التحقق المفرط. احذف القاعدة العامة. إذا كانت هناك خطوة محددة تتطلب بالفعل فحصًا صريحًا، فحدد التعليمات لتلك الخطوة فقط.
لماذا Opus 5 مطوَّل جدًا حتى عند الجهد المنخفض؟ لأن الجهد يتحكم في التفكير، وليس في طول الإخراج المرئي. يقلل خفض الجهد من رموز التفكير بينما تظل الاستجابات بنفس الطول تقريبًا. قم بتعيين حد للكلمات أو التنسيق في الأمر (prompt) نفسه.
كيف أمنع Opus 5 من إنشاء وكلاء فرعيين؟ قل ذلك مباشرة: "لا تنشئ وكلاء فرعيين؛ تعامل مع هذا في هذه المحادثة." إذا كان بعض التوسع مفيدًا، فامنح حدًا رقميًا وقصره على العمل المستقل المتوازي.
لماذا أرى علامات <thinking> في مخرجاتي؟ يظهر هذا العيب أحيانًا عند تعطيل التفكير. لا تضف تعليمات للأوامر (prompt) تسمي العلامات، لأن ذلك يزيد من احتمالية التسرب. الحل الموصى به من Anthropic هو إبقاء التفكير ممكّنًا واستخدام مستوى جهد أقل للتحكم في التكلفة.
ماذا يحدث إذا عادت استدعاء أداة كنص عادي؟ لا يتم تنفيذ أي شيء، ويبقى النص المتسرب في سجل المحادثة حيث تتعامل الأدوار اللاحقة معه كإجراء مكتمل. تحقق من أدوار المساعد قبل إضافتها إلى السجل، وفضل إبقاء التفكير ممكّنًا بدلاً من تعطيله.
