على مدار العامين الماضيين، كان السؤال "ما هو أفضل نموذج لبرمجة الأكواد؟" يحمل إجابة غربية. كنت تختار GPT أو Claude أو Gemini، وتدفع تكلفة الرمز المميز، وتقبل أن الأوزان تظل محجوبة في مركز بيانات شخص آخر. لم يعد هذا هو المسار الوحيد. فقد بدأت مجموعة من المعامل الصينية الآن في شحن نماذج تضاهي أحدث التقنيات في مجال البرمجة، إما بنشر الأوزان أو بتسعير واجهة برمجة التطبيقات (API) بأسعار منخفضة جدًا لدرجة أنها تغير حسابات كل وكيل تقوم بتشغيله.
وصل MiniMax M3 في 1 يونيو 2026، وهو أوضح إشارة حتى الآن. إنه مفتوح الأوزان، ومصمم للبرمجة والعمل الوكيلي، ويحتوي على نافذة سياق بحجم 1,000,000 رمز مميز، ويضيف إمكانيات الوسائط المتعددة الأصلية فوق ذلك. إنه ثالث منافس جاد مفتوح الأوزان يصل في غضون أسابيع، إلى جانب عائلة DeepSeek V4 وQwen 3.7 من Alibaba. إذا كنت تريد أوزانًا مفتوحة وتكلفة منخفضة وعدم الارتباط بمورد معين، فلديك الآن قائمة مختصرة حقيقية بدلاً من خيار واحد.
المنافسون الثلاثة
MiniMax M3 هو الوافد الجديد. تصفه MiniMax بأنه نموذج برمجة رائد مع نافذة سياق بحجم مليون رمز مميز وقدرة وسائط متعددة أصلية، مما يعني أنه يتعامل مع مدخلات الصور والفيديو ويمكنه تنفيذ مهام استخدام الكمبيوتر، وليس النصوص فقط. يعمل على بنية MSA جديدة. تقول MiniMax إن الأوزان المفتوحة والتقرير الفني سيتبعان ذلك في غضون حوالي عشرة أيام من الإطلاق، ولم تكشف عن عدد المعلمات. التفاصيل الكاملة متوفرة في ما هو MiniMax M3.
DeepSeek V4-Pro هو حصان العمل في التفكير والبرمجة. إنه نموذج تفكير: يعرض سلسلة من الأفكار reasoning_content قبل إجابته النهائية، والتي تلتقط التبعيات متعددة الملفات التي تفوتها نماذج الإكمال المباشر. يمتلك DeepSeek تاريخًا طويلاً وموثقًا في نشر الأوزان المفتوحة عبر خطوطه R1 وV3، ويجمع V4-Pro مع نسخة V4-Flash غير مفكرة وأرخص. الميزة البارزة هي السعر، والتي سنتناولها لاحقًا. يدير DeepSeek موقعه الرسمي وواجهة برمجة التطبيقات (API) على deepseek.com.
Qwen 3.7 هو الرائد من Alibaba، بقيادة Qwen3.7-Max-Preview. إنه نموذج تفكير مع نافذة سياق بحجم مليون رمز مميز، ويُروّج له بقوة لمهام الوكلاء طويلة المدى. هناك تحذير صريح واحد في صميم هذه المقارنة: اعتبارًا من إطلاقه في منتصف مايو 2026، فإن الرائد Qwen3.7-Max هو مملوك ومغلق الأوزان. تتمتع Alibaba بسجل حافل في فتح المصدر للطبقة الأدنى من نماذجها الرائدة، لذا فإن الأوزان المفتوحة لـ 3.7 قد تكون محتملة لاحقًا، ولكن لم يتم شحن أي منها بعد. التفاصيل الكاملة موجودة في ما هو Qwen 3.7. مستودعات Alibaba مفتوحة المصدر موجودة على github.com/QwenLM.
جدول المواصفات
| المواصفة | MiniMax M3 | DeepSeek V4-Pro | Qwen3.7-Max-Preview |
|---|---|---|---|
| المورد | MiniMax | DeepSeek | Alibaba (Qwen) |
| تاريخ الإصدار | 1 يونيو 2026 | 2026 | مايو 2026 (معاينة) |
| أوزان مفتوحة | نعم (الأوزان خلال ~10 أيام) | نعم (سجل DeepSeek عبر R1/V3) | ليس بعد (النموذج الرائد مغلق الأوزان) |
| نافذة السياق | 1,000,000 رمز مميز | لم يُذكر هنا | 1,000,000 رمز مميز |
| متعدد الوسائط | نعم (صورة + فيديو، استخدام الكمبيوتر) | لا (نص + تفكير) | تفكير يركز على النص |
| وضع التفكير / الاستدلال | نعم | نعم (reasoning_content) |
نعم (تفكير موسع) |
| عدد المعلمات | لم يُكشف عنه | لم يُكشف عنه هنا | لم يُكشف عنه هنا |
| البنية | MSA | لم تُذكر هنا | لم تُذكر هنا |
ملاحظة حول صف "الأوزان المفتوحة"، لأنه العمود الفقري لهذه المقارنة. M3 يلتزم بنشر الأوزان وتقرير تقني في غضون عشرة أيام من الإطلاق. DeepSeek أطلقت أوزانًا مفتوحة بشكل متكرر. النموذج الرائد Qwen 3.7 مغلق اليوم. إذا كانت الأوزان المفتوحة مطلبًا أساسيًا الآن، فهذا يضيق نطاق خياراتك قبل قراءة أي معيار واحد.
قوة البرمجة والوكالة
هنا تصبح البيانات غير متكافئة، لذا سنبدأ بما هو مؤكد ونبقى وصفيين حيثما لا يكون كذلك.
أطلق MiniMax M3 مع مجموعة كاملة من معايير البرمجة والوكالة المبلغ عنها من قبل المورد. هذه هي أرقام MiniMax الخاصة، لذا تعامل معها على أنها ادعاءات مورد في يوم الإطلاق حتى يقوم أطراف ثالثة بإعادة إنتاجها:
| المعيار (مُبلغ عنه من قبل المورد، MiniMax) | MiniMax M3 |
|---|---|
| SWE-Bench Pro | 59.0% |
| Terminal-Bench 2.1 | 66.0% |
| SWE-fficiency | 34.8% |
| KernelBench Hard | 28.8% |
| MCP Atlas | 74.2% |
| PostTrainBench | 0.37 |
| SVG-Bench | مُبلغ عنه أعلى من Opus 4.7 |
| OmniDocBench | مُبلغ عنه أعلى من Gemini 3.1 Pro |
| Claw-Eval | مُبلغ عنه كالأعلى في مجموعته |
يقيس SWE-Bench Pro وTerminal-Bench مهام هندسة البرمجيات الحقيقية: حل مشاكل GitHub، العمل في الطرفية. يقيس MCP Atlas استخدام الأدوات وتنسيق الوكلاء. يصفون معًا نموذجًا مصممًا للقيام بعمل برمجي وكيلي، وليس مجرد الإكمال التلقائي. يمكنك التحقق من صحة مجال SWE-Bench على لوحة المتصدرين SWE-Bench.
بالنسبة لـ DeepSeek V4-Pro و Qwen 3.7، لا يتم نشر أرقام البرمجة الوكيلية المشابهة بنفس التنسيق، لذا فإن مطابقة مباشرة خلية بخلية ستكون افتراضية، ولن نقوم بذلك. ما هو موثق:
- DeepSeek V4-Pro يحقق قدرته على البرمجة ضمن نقاط قليلة من معايير GPT-5.5 وفقًا لمقارنات الطرف الثالث، بينما يكلف جزءًا بسيطًا من السعر. سلسلة التفكير الخاصة به هي الميزة العملية: في عمليات إعادة هيكلة الملفات المعقدة، وإعادة التسمية، وتغييرات التوقيع، تلتقط تمريرة التفكير التبعيات في لقطة واحدة تحتاج النماذج المسطحة إلى ثلاث جولات للتعامل معها. تفاصيل الإعداد وحساب التكلفة موجودة في كيفية استخدام DeepSeek V4-Pro مع Cursor.
- سجل Qwen 3.7 57 نقطة على مؤشر تحليل الذكاء الاصطناعي، وهو مؤشر مركب يمزج التفكير والمعرفة والرياضيات والبرمجة، وقد تم الإبلاغ عنه كأفضل نتيجة في تلك اللوحة عند الإطلاق، بالإضافة إلى حوالي 1,475 نقطة Elo على LM Arena مع ترتيب ضمن العشرة الأوائل في فئة البرمجة. تتمثل ميزة Alibaba في عمل الوكلاء طويل المدى: تشغيل ذاتي مستدام واستخدام مكثف للأدوات عبر العديد من الخطوات.
القراءة الصادقة: M3 يأتي مع أوضح دليل على البرمجة الوكيلية اليوم لأنه نشر أرقامًا على مستوى المهام. قوة DeepSeek تكمن في جودة الكود المدفوعة بالتفكير بسعر منخفض. قوة Qwen تكمن في الذكاء المركب والتحمل في سلاسل الوكلاء الطويلة. حتى يقوم DeepSeek و Qwen بالإبلاغ عن نفس مهام SWE-Bench Pro و Terminal-Bench، قم بتشغيل عبء العمل الخاص بك من خلال الثلاثة جميعًا، والذي نغطيه في النهاية. تتوفر مقارنة أوسع للنماذج الرائدة لـ Qwen في Qwen 3.7 مقابل GPT-5.5 مقابل Opus 4.7.
نافذة السياق وتكلفة السياق الطويل
اثنين من الثلاثة يعلنان عن نافذة سياق بحجم 1,000,000 رمز مميز: MiniMax M3 و Qwen3.7-Max. لم يتم ذكر سياق DeepSeek V4-Pro هنا، لذا لن نذكر رقمًا له.
مليون رمز مميز يعادل تقريبًا 700,000 إلى 750,000 كلمة. هذا يكفي لاحتواء مستودع متوسط الحجم، مجموعة من ملفات PDF الطويلة، أو أشهر من المحادثات في طلب واحد، بدون تقسيم يدوي وبدون طبقة استرجاع للحفاظ عليها. بالنسبة للتفكير على مستوى المستودع بالكامل، فإنه يزيل الكثير من التعقيدات.
يوجد تحذيران للحفاظ على الصدق. أولاً، نافذة كبيرة هي سقف، وليست ضمانًا. غالبًا ما تسترجع النماذج وتستدل بشكل أقل موثوقية كلما امتلأت النافذة، ولا يزال الاختبار المستقل للسياق الطويل لهذه الإصدارات الجديدة ضئيلًا. ثانيًا، السياقات الكبيرة تكلف مالًا. كل رمز مميز ترسله يتم تحصيله، لذا فإن موجهًا بمليون رمز مميز هو موجه باهظ الثمن.
هذا هو المكان الذي يُفترض أن بنية MSA في M3 تحدث فرقًا. تصفها MiniMax بأنها مصممة لكفاءة السياق الطويل، مع معدل API قياسي يصل إلى 512 ألف رمز مميز كمدخلات ومعدل منفصل للسياق الطويل فوق هذا الحد. يوضح هذا التقسيم الواقع الاقتصادي بوضوح: السياق الطويل هو طبقة مميزة، في كل نموذج يمتلكها. الدفاع العملي هو نفسه بغض النظر عن النموذج الذي تختاره. استخدم النافذة الكاملة فقط عندما تتطلب المهمة ذلك، وقللها بقوة عندما لا تحتاج إليها. توجد تكتيكات ملموسة للحفاظ على سياق الوكيل نحيلًا في كيفية تقليل تكاليف رموز الوكيل.
السعر والوصول
السعر هو السبب وراء وجود هذه المقارنة. نفس عبء العمل الذي يكلف أموالاً حقيقية على نموذج رائد غربي يعمل بجزء بسيط من التكلفة هنا، وهذه الفجوة هي المحرك وراء حرب أسعار LLM الصينية 2026.
DeepSeek V4-Pro ينشر أوضح أرقام التكلفة لكل رمز مميز من الثلاثة. الأسعار القياسية، دائمة اعتبارًا من مايو 2026:
| نوع الرمز المميز | سعر DeepSeek V4-Pro لكل مليون رمز مميز |
|---|---|
| المدخل (خطأ في ذاكرة التخزين المؤقت) | 0.435 دولار |
| المدخل (إصابة ذاكرة التخزين المؤقت) | 0.003625 دولار |
| المخرج | 0.87 دولار |
هذا السعر للمخرجات يعادل تقريباً 1/34 من تكلفة مخرجات GPT-5.5. نسخة V4-Flash غير المفكرة أرخص بكثير بسعر 0.14 دولار / 0.28 دولار لكل مليون رمز مميز مدخل / مخرج. قد يكلف يوم عمل مكثف مساعد البرمجة حوالي دولار واحد. هذا هو الرقم الذي يجعل DeepSeek صعب التغاضي عنه لحركة المرور الوكيلية ذات الحجم الكبير.
يبيع MiniMax M3 خططًا للرموز بدلاً من سعر واحد منشور لكل رمز: Plus بسعر 20 دولارًا، Max بسعر 50 دولارًا، وUltra بسعر 120 دولارًا. تستخدم واجهة برمجة التطبيقات الخاصة به سعرًا قياسيًا للمدخلات حتى 512 ألف رمز مميز وسعرًا خاصًا للسياق الطويل فوق هذا الحد. لم تنشر MiniMax رقمًا دقيقًا لكل رمز مميز، لذا لن نقتبس واحدًا. يناسب هيكل الخطة الفرق التي ترغب في إنفاق شهري يمكن التنبؤ به بدلاً من الفواتير المدفوعة حسب الاستخدام. تفاصيل التوصيل موجودة في كيفية استخدام واجهة برمجة تطبيقات MiniMax M3.
يتم تحصيل رسوم Qwen 3.7 لكل رمز مميز عبر Alibaba Cloud، حيث تم إطلاق معاينة Max في مايو 2026. قامت Alibaba بتسعير إصدارات Qwen الأخيرة بقوة كجزء من نفس حرب الأسعار، ولكن الأسعار الدقيقة لنموذج المعاينة يمكن أن تتغير، لذا تحقق من وثائق النموذج الحالية في Alibaba Cloud للحصول على السعر الفعلي.
فيما يتعلق بالوصول، فإن زاوية الأوزان المفتوحة تغير سقف التكلفة بالكامل. تعني الأوزان المنشورة لـ M3 وإصدارات DeepSeek المفتوحة أنه يمكنك استضافتها بنفسك والدفع فقط مقابل الأجهزة، بدون أي عداد لكل رمز مميز. لا يمكن استضافة Qwen3.7-Max بنفسك اليوم لأن أوزانه الرئيسية ليست منشورة، لذا فإن كل طريق إليه يمر عبر واجهة برمجة تطبيقات Alibaba. إذا كان الهدف هو تجنب الارتباط بمورد معين، فهذا فرق حقيقي.
أي واحد تختار
يعتمد النموذج الصحيح على ما تسعى لتحسينه. طابق أولويتك مع العمود.
| أولويتك | الأكثر ملاءمة | السبب |
|---|---|---|
| البرمجة الوكيلية مع معايير منشورة | MiniMax M3 | أرقام SWE-Bench Pro / Terminal-Bench / MCP Atlas شفافة عند الإطلاق (مُبلغ عنها من قبل المورد) |
| مدخلات متعددة الوسائط (صورة، فيديو، استخدام الكمبيوتر) | MiniMax M3 | الوحيد من الثلاثة الذي يمتلك قدرة متعددة الوسائط أصلية |
| أقل تكلفة على حركة مرور واجهة برمجة التطبيقات ذات الحجم الكبير | DeepSeek V4-Pro | حوالي 0.87 دولار / مليون مخرج، مع نسخة Flash أرخص وتسعير عند إصابة ذاكرة التخزين المؤقت |
| جودة الكود المدفوعة بالتفكير في عمليات إعادة الهيكلة الصعبة | DeepSeek V4-Pro | سلسلة التفكير تلتقط التبعيات متعددة الملفات في تمريرة واحدة |
| أعلى درجة ذكاء مركب في لوحة عامة | Qwen3.7-Max | مؤشر AA للذكاء 57، أُبلغ عنه كأول نتيجة عند الإطلاق |
| تشغيل وكلاء مستقلين طويل المدى | Qwen3.7-Max أو MiniMax M3 | كلاهما يبرزان القدرة على التحمل والاستخدام المكثف للأدوات؛ M3 ينشر أيضًا MCP Atlas |
| الاستضافة الذاتية / عدم الارتباط بمورد معين اليوم | MiniMax M3 أو DeepSeek V4-Pro | كلاهما ينشر أوزانًا مفتوحة؛ نموذج Qwen الرئيسي مغلق |
قراءات بسيطة قليلة. إذا كانت الأوزان المفتوحة وأدلة البرمجة الوكيلية هي أهم أولويتين لديك، فإن M3 هو الخيار الأوضح الآن، مع التحذير بأن أوزانه وتقريره الفني كانا لا يزالان على بعد أيام قليلة من الإطلاق، ومعاييره مُبلغ عنها من قبل المورد. إذا كنت تدير حجمًا كبيرًا من حركة المرور عبر واجهة برمجة التطبيقات (API) وتريد أقل فاتورة، فإن سعر DeepSeek V4-Pro هو العنوان الرئيسي. إذا كنت تريد أعلى درجة مركبة عامة وكنت مرتاحًا بالبقاء على واجهة برمجة تطبيقات مستضافة، فإن Qwen3.7-Max يناسبك، طالما أنك لا تحتاج إلى الاستضافة الذاتية.
اختبرها بنفسك
تخبرك لوحة المتصدرين كيف يعمل النموذج على مهام شخص آخر. لا تخبرك كيف يعمل على مهامك الخاصة. جميع هذه النماذج الثلاثة توفر واجهة برمجة تطبيقات (API)، وأسرع طريقة لحسم الاختيار هي تشغيل نفس المطالبات على كل منها ومقارنة الاستجابات جنبًا إلى جنب.
هذه مهمة لـ Apidog. قم بإعداد مشروع Apidog واحد مع ثلاث بيئات، واحدة لكل واجهة برمجة تطبيقات نموذج، واستورد مخطط إكمال الدردشة المتوافق مع OpenAI الذي تستخدمه كل منها. ثم يمكنك:
- إرسال نفس دفعة المطالبات إلى M3 و V4-Pro و Qwen3.7-Max ومقارنة المخرجات في مكان واحد.
- تسجيل الاستجابات الذهبية وإعادة تشغيلها عند كل تغيير في المطالبة لالتقاط الانحرافات.
- التحقق من صحة أشكال
tool_callsوreasoning_contentباستخدام تأكيدات JSON Schema، حتى لا يؤدي تعديل خاطئ لموجه النظام إلى تعطيل وكيلك بصمت.
قم بتنزيل Apidog، ووجه ثلاث بيئات إلى نقاط نهاية النموذج الثلاثة، وسيكون لديك مقعد مقارنة عملي في غضون دقائق قليلة. تفاصيل إعداد واجهة برمجة التطبيقات للنموذج الأحدث موجودة في كيفية استخدام واجهة برمجة تطبيقات MiniMax M3.
الأسئلة الشائعة
ما هو أفضل نموذج برمجة مفتوح الأوزان في عام 2026 الآن؟
للحصول على أدلة برمجة وكيلية قابلة للتحقق عند الإطلاق، يتصدر MiniMax M3، لأنه نشر معايير على مستوى المهام مثل SWE-Bench Pro بنسبة 59.0% و Terminal-Bench 2.1 بنسبة 66.0% (مُبلغ عنها من قبل المورد). DeepSeek V4-Pro هو الخيار القيم: برمجة ضمن نقاط قليلة من GPT-5.5 بحوالي 1/34 من سعر الإخراج. يتصدر Qwen3.7-Max لوحة متصدرين مركبة ولكنه ليس مفتوح الأوزان بعد. الإجابة الصادقة هي أن أرقام البرمجة المباشرة غير قابلة للمقارنة بشكل مباشر عبر الثلاثة، لذا قم بتشغيل عبء العمل الخاص بك قبل الالتزام.
هل جميع الثلاثة مفتوحة الأوزان حقًا؟
ليس بعد. MiniMax M3 مفتوح الأوزان، ومن المقرر إصدار الأوزان وتقرير فني في غضون عشرة أيام من إطلاقه في 1 يونيو 2026. يمتلك DeepSeek سجلًا طويلًا في نشر الأوزان المفتوحة عبر عائلتيه R1 وV3. Qwen3.7-Max-Preview، وهو النموذج الرئيسي الذي يقصده معظم الناس بـ "Qwen 3.7"، هو مملوك ومغلق الأوزان اعتبارًا من منتصف مايو 2026. قد تقوم Alibaba بفتح مصدر طبقة أدنى منه لاحقًا، ولكن تعامل مع ذلك على أنه محتمل، وليس مؤكدًا. التفاصيل موجودة في ما هو Qwen 3.7.
أي منها يمتلك أكبر نافذة سياق؟
يعلن كل من MiniMax M3 و Qwen3.7-Max عن نافذة بحجم 1,000,000 رمز مميز، أي ما يقرب من 700,000 إلى 750,000 كلمة. لم يتم ذكر سياق DeepSeek V4-Pro هنا. تذكر أن النافذة الكبيرة هي سقف، وليست وعدًا بالاستدعاء المثالي، ويتم تحصيل رسوم على كل رمز مميز فيها.
أي منها الأقل تكلفة للتشغيل؟
بناءً على أسعار الرموز المميزة المنشورة، يعد DeepSeek V4-Pro هو الرائد الواضح: حوالي 0.87 دولار لكل مليون رمز مميز إخراج، مع نسخة V4-Flash غير المفكرة والأرخص بسعر 0.14 دولار / 0.28 دولار. يبيع MiniMax M3 خططًا شهرية للرموز (20 دولارًا / 50 دولارًا / 120 دولارًا) بدلاً من سعر منشور لكل رمز مميز. يتم تحصيل رسوم Qwen 3.7 لكل رمز مميز على Alibaba Cloud. إذا كان بإمكانك الاستضافة الذاتية، فإن نماذج الأوزان المفتوحة تخفض تكلفتك الهامشية إلى الأجهزة وحدها. الصورة العامة للأسعار موجودة في حرب أسعار LLM الصينية 2026.
هل MiniMax M3 أفضل بالفعل من DeepSeek V4-Pro في البرمجة؟
أرقام المعايير غير قابلة للمقارنة بشكل مباشر بعد. نشر M3 نتائج SWE-Bench Pro و Terminal-Bench عند الإطلاق؛ لم يبلغ DeepSeek عن نفس المهام بنفس التنسيق. ميزة M3 اليوم هي الأدلة المنشورة بالإضافة إلى الوسائط المتعددة. ميزة DeepSeek هي السعر وسلسلة التفكير القوية في عمليات إعادة هيكلة الملفات المتعددة. تتحدث الثلاثة جميعًا واجهة برمجة تطبيقات متوافقة مع OpenAI، لذا فإن الاختبار العادل هو تشغيل نفس المطالبات على كل منها في مستودعك الخاص قبل اتخاذ القرار.
النسخة المختصرة
ثلاثة منافسين مفتوحي الأوزان يصلون الآن إلى أحدث التقنيات في مجال البرمجة، ويعتمد الاختيار على ما تسعى لتحسينه. اختر MiniMax M3 إذا كنت تريد معايير برمجة وكيلية منشورة، وسياق بحجم مليون رمز مميز، ووسائط متعددة، ويمكنك الانتظار بضعة أيام حتى يتم إطلاق أوزانه. اختر DeepSeek V4-Pro إذا كانت التكلفة المنخفضة وجودة الكود المدفوعة بالتفكير هي الأهم، حيث أن سعره لكل رمز مميز هو الأقل بين الثلاثة وأوزانه متاحة. فكر في Qwen3.7-Max إذا كنت تريد أعلى درجة مركبة عامة وكنت مرتاحًا باستخدام واجهة برمجة تطبيقات مستضافة، مع العلم أن نموذجه الرئيسي ليس مفتوح الأوزان اليوم.
ستستمر أرقام المعايير في التغير، ولا يزال العديد من أرقام M3 مُبلغ عنها من قبل المورد. النصيحة الدائمة لا تتغير: قم بتشغيل نفس المطالبات على واجهات برمجة التطبيقات الثلاثة في مشروع Apidog واحد، وراقب المخرجات والفواتير، ودع عبء عملك يختار الفائز.
button
