أعطت DeepSeek لمستخدمي deepseek-v4-pro مهلة أربعة أيام. بحلول 14 سبتمبر 2026 في الساعة 04:00 بالتوقيت العالمي المنسق (12:00 بتوقيت بكين)، سيتم توجيه كل طلب يذكر deepseek-v4-pro إلى DeepSeek-V4.1-Flash ويتم احتسابه بأسعار V4.1-Flash. لن تحدث أي أخطاء. لن تظهر أي تحذيرات. ستنخفض فاتورتك، وسيبدأ نموذج مختلف في الإجابة على استفساراتك.
هذا الجزء الأخير هو ما يجب التخطيط له. تشير ملاحظة الإصدار إلى التغيير كترقية، وهو كذلك بناءً على أرقام DeepSeek الخاصة. لكن "إعادة التوجيه بصمت" ليس هو نفسه "اختبار". إذا كان منتجك يعتمد على شكل معين لاستدعاء الأداة أو ميزانية زمن استجابة قمت بضبطها مقابل V4-Pro، فأنت تريد معرفة التغييرات قبل يوم الأحد، وليس بعده.
يغطي هذا الدليل ما أعلنته DeepSeek، وماذا يحدث إذا لم تفعل شيئًا، وقائمة تحقق للترحيل، وطريقة لإنشاء مجموعة اختبار الانحدار (Pro مقابل Flash) في Apidog بحيث يصبح التبديل أمرًا عاديًا. للنموذج نفسه، اقرأ ما هو DeepSeek-V4.1-Flash أولاً.
باختصار
- التحويل: 14 سبتمبر 2026، الساعة 04:00 بالتوقيت العالمي المنسق. يتم توجيه طلبات
deepseek-v4-proإلى V4.1-Flash من تلك اللحظة. - لن تفشل مكالماتك ولن تدفع أسعار Pro. ينخفض إدخال فقدان ذاكرة التخزين المؤقت (cache-miss) في الذروة من 1.32 دولار إلى 0.30 دولار لكل مليون رمز (أقل بنسبة 77%)؛ وينخفض الإخراج من 3.96 دولار إلى 1.20 دولار (أقل بنسبة 70%).
- أعد تسمية معرف النموذج إلى
deepseek-flashبنفسك، ثم أعد اختبار استدعاء الوظائف، والإخراج المنظم، والتدفق، وجهد الاستدلال. - تقول DeepSeek أن V4.1-Flash يتفوق على V4-Pro في كل معيار مدرج. هذه أرقام المورد. قم بتشغيل تقييماتك الخاصة.
ما أعلنته DeepSeek في 10 سبتمبر
يغطي إدخال سجل التغييرات بتاريخ 10 سبتمبر أمرين: إطلاق V4.1-Flash بشكل عام (GA) على واجهة برمجة التطبيقات (API)، وتقاعد V4-Pro بعد أربعة أيام.

فيما يتعلق بـ V4-Pro، الصياغة مباشرة. تقول DeepSeek إن V4.1-Flash "تجاوز V4 Pro بشكل شامل في الأداء والتكلفة والسرعة والوقت الإجمالي"، مستشهدة بـ "اختبارات أجرتها أطراف متعددة". اعتبارًا من 14 سبتمبر في الساعة 04:00 بالتوقيت العالمي المنسق، سيتم تقديم الطلبات الموجهة إلى deepseek-v4-pro بواسطة V4.1-Flash وبأسعار V4.1-Flash. لا توجد فترة سماح حيث يستمر Pro في العمل تحت اسم قديم.
تنظيف التسميات يتجاوز Pro:
| اسم النموذج | الحالة بعد 10 سبتمبر |
|---|---|
deepseek-flash |
معرف أساسي جديد لـ V4.1-Flash |
deepseek-v4-flash |
لا يزال مقبولاً، ويخدمه V4.1-Flash |
deepseek-v4-flash-vision-exp |
لا يزال مقبولاً، ويخدمه V4.1-Flash |
deepseek-v4-pro |
يخدمه V4-Pro حتى 14 سبتمبر 04:00 بالتوقيت العالمي المنسق، ثم يتم إعادة توجيهه إلى V4.1-Flash |
تم إيقاف نموذجي V4-Flash و V4-Flash-Vision-Exp؛ فقط أسماؤهما لا تزال قائمة كأسماء مستعارة. لا تتغير عناوين URL الأساسية: https://api.deepseek.com للتنسيق المتوافق مع OpenAI و https://api.deepseek.com/anthropic للتنسيق المتوافق مع Anthropic. يغطي دليل كيفية استخدام واجهة برمجة تطبيقات V4.1-Flash معرف النموذج الجديد، والتحكم في الاستدلال، وإدخال الصور بالتفصيل.
ماذا يحدث إذا لم تفعل شيئًا
باختصار: سيستمر تكاملك في العمل وسيصبح أرخص. النسخة الأطول: خمسة أشياء ستتغير.
- نموذج مختلف يجيب. V4.1-Flash هو نموذج MoE (Expert Mixture) بمعلمة 552B مع تصميم جديد للمشفر والمفكك السببي (Causal Encoder-Decoder): 40 طبقة، 20 مشفرًا و 20 مفككًا، 8 مليار معلمة نشطة أثناء التعبئة المسبقة و 16 مليار أثناء فك التشفير. ستواجه استفساراتك الآن ميزانية معلمات نشطة مختلفة وتصميم انتباه مختلف (Compressed Sparse Attention 2). توقع صياغة مختلفة، وإسهاب افتراضي مختلف، وقرارات مختلفة أحيانًا بشأن استدعاءات الأدوات الحدودية.
- سقف الإخراج هو نفسه، لكن الإعدادات الموصى بها ليست كذلك. يسرد كلا النموذجين سياقًا بحجم 1 مليون و 384 ألف كحد أقصى للإخراج. توصي بطاقة نموذج V4.1-Flash بدرجة حرارة 1.0، و top_p 0.95 أو 1.0، ورموز بحد أقصى 256 ألف أو أكثر. إذا قمت بتعيين
max_tokensمحدودًا على V4-Pro للحد من التكلفة، فتحقق مما إذا كان إخراج الاستدلال الآن يُقتطع قبل وصول الإجابة. - يعمل جهد الاستدلال على مقياس مختلف. تصف DeepSeek جهد استدلال V4.1-Flash بأنه "يمكن التحكم فيه باستمرار" على مقياس من 1 إلى 100. قبل V4-Flash كان يقبل
reasoning_effortبالإضافة إلىextra_body={"thinking": {"type": "enabled"}}. كيفية ربط المقياس من 1 إلى 100 بمعلمة واجهة برمجة التطبيقات [تحقق] مقابل الوثائق الحالية؛ لا تفترض أن مستوى مسمى مثل"high"يعني العمق الذي كان عليه في Pro. - تتغير الأسعار لصالحك، مع نافذة ذروة. ساعات الذروة هي من الاثنين إلى الجمعة، من 01:00 إلى 04:00 ومن 06:00 إلى 10:00 بالتوقيت العالمي المنسق. خارج أوقات الذروة هو نصف سعر الذروة. تدفع حركة مرور Pro التي أعيد توجيهها أسعار Flash في كلتا الفترتين.
- قفز في سعة التزامن. كان حد V4-Pro هو 500 طلب متزامن. حد Flash هو 2,500. ترث الحركة المرور المعاد توجيهها الحد الأعلى، لذا أعد النظر في أي تأجيل من جانب العميل تم ضبطه لـ 500.
قائمة التحقق للترحيل
- إعادة تسمية معرف النموذج. ابحث في قاعدة التعليمات البرمجية والتكوينات الخاصة بك عن
deepseek-v4-proواستبدلها بـdeepseek-flash. افعل ذلك حتى لو كان الاسم المستعار لا يزال يعمل: المعرفات الصريحة تجعل الحوادث أسهل للقراءة لاحقًا.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DEEPSEEK_API_KEY"],
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-flash", # كان "deepseek-v4-pro"
messages=[
{"role": "system", "content": "أنت تقوم بفرز تذاكر الدعم. أعد كائن JSON يحتوي على الأولوية والفريق والملخص."},
{"role": "user", "content": "العميل يبلغ أن عملية الدفع تعيد 502 بعد تطبيق رمز خصم."},
],
response_format={"type": "json_object"},
)
print(response.choices[0].message.content)
- مراجعة إعدادات جهد الاستدلال. اذكر كل مكان قمت فيه بتعيين
reasoning_effortأو تبديل التفكير. قرر لكل نقطة نهاية ما إذا كنت تريد العمق أو زمن الاستجابة، ثم اختبر كل منها مقابل المقياس الجديد بدلاً من استخدام القيمة القديمة. - أعد تشغيل اختبارات استدعاء الوظائف والإخراج المنظم. تنسيق وسيطات استدعاء الأداة هو النقطة التي تكون فيها تبديلات النماذج الأكثر صعوبة. إذا كتبت اختبارات عندما قمت بإعداد استدعاء الوظائف على V4-Pro، فقم بتشغيلها الآن مقابل
deepseek-flash. إذا لم تفعل ذلك، فإن سير عمل Apidog أدناه يوفر لك مجموعة. - تحقق من محولك لتدفق البيانات (streaming parsers). يقوم V4.1-Flash ببث دلتا الاستدلال ودلتا الإجابة بشكل منفصل في وضع التفكير. تأكد من أن معالج SSE الخاص بك لا يدمجها وأن مؤقت "الرمز الأول" يقيس ما تعتقد أنه يقيسه.
- إعادة تعيين خط الأساس لزمن الاستجابة والتكلفة. سجل زمن الاستجابة p50 و p95 بالإضافة إلى الرموز لكل طلب على V4-Pro هذا الأسبوع، ثم نفس الشيء على
deepseek-flash. ستحتاج إلى كلا الرقمين عندما يسأل أحدهم لماذا تغيرت لوحة التحكم يوم الاثنين. - تحديث لوحات التحكم والميزانيات. ستتوقف تنبيهات التكلفة المعايرة لـ 3.96 دولار للإخراج في الذروة بمجرد أن تدفع 1.20 دولار، والميزانية التي لا يتم تفعيلها أبدًا هي ميزانية لا ينظر إليها أحد. أعد تعيين الحدود إلى الأسعار الموجودة في صفحة الأسعار وقم بإصلاح أي تحليل لكل نموذج يقوم بالتصفية على المعرف القديم.
إذا كنت تستدعي تنسيقات Anthropic المتوافقة أو تنسيقات Responses API بدلاً من إكمال الدردشة، تنطبق نفس الخطوات؛ تُظهر مقارنة تنسيقات واجهة برمجة تطبيقات V4-Pro شكل كل طلب حتى تتمكن من مطابقة الحقول.
نظرة سريعة على V4-Pro مقابل V4.1-Flash
أرقام المعايير المبلغ عنها من قبل DeepSeek، مأخوذة من بطاقة نموذج V4.1-Flash. الأسعار بالدولار الأمريكي لكل مليون رمز، سارية اعتبارًا من 10 سبتمبر 2026.
| deepseek-v4-pro | deepseek-flash (V4.1) | |
|---|---|---|
| المعلمات النشطة | لم يُذكر مرة أخرى في بطاقة V4.1 | 8B تعبئة مسبقة / 16B فك تشفير |
| HumanEval | 76.8 | 79.4 |
| GSM8K | 92.6 | 93.0 |
| DeepSWE v1.1 | 62.7 | 74.2 |
| Terminal-Bench 2.1 | 87.9 | 90.6 |
| الإدخال، ذاكرة التخزين المؤقت (خارج الذروة / الذروة) | $0.022 / $0.044 | $0.003 / $0.006 |
| الإدخال، فقدان ذاكرة التخزين المؤقت (خارج الذروة / الذروة) | $0.66 / $1.32 | $0.15 / $0.30 |
| الإخراج (خارج الذروة / الذروة) | $1.98 / $3.96 | $0.60 / $1.20 |
| السياق / الحد الأقصى للإخراج | 1M / 384K | 1M / 384K |
| حد التزامن | 500 | 2,500 |
أكبر فجوة هي DeepSWE، بزيادة 11.5 نقطة. الأصغر هي GSM8K، بزيادة 0.4. إذا كان عبء عملك يشبه الرياضيات المدرسية، فتوقع التكافؤ؛ أما إذا كان يشبه تعديلات التعليمات البرمجية متعددة الملفات، فإن أرقام DeepSeek تشير إلى أنك ستكسب. التفاصيل ثلاثية الأبعاد بما في ذلك V4-Flash موجودة في V4.1-Flash مقابل V4-Pro مقابل V4-Flash.
المخاطرة: معايير المورد تقيس مهام المورد
كل رقم في هذا الجدول جاء من DeepSeek. "اختبارات أجرتها أطراف متعددة" هي عبارة DeepSeek، ولم يتم تسمية الأطراف في ملاحظة الإصدار. هذا لا يجعل الأرقام خاطئة. بل يعني أنها قورنت على مجموعات معيارية، وليس على استفساراتك، أو مخططات أدواتك، أو مدخلات المستخدمين الفوضوية.
يمكن للنموذج أن يحقق درجة أعلى في Terminal-Bench ومع ذلك يغير طريقة تنسيقه لوسيطة استدعاء الأداة التي يعتمد عليها محللك. الرموز الإخراجية الأرخص لا تساعد إذا كان النموذج يكتب ضعف الكمية. الطريقة الوحيدة لمعرفة ذلك هي تشغيل حركة المرور الخاصة بك عبر كلا النموذجين طالما أن كلاهما موجود. لديك حتى 14 سبتمبر.
أنشئ مجموعة اختبار الانحدار في Apidog قبل التحويل
إليك سير عمل في Apidog يمنحك مقارنة متكررة بين Pro و Flash ويسلم التشغيل إلى CI.
- استورد طلبات V4-Pro الموجودة لديك. استورد مواصفات OpenAPI المتوافقة مع OpenAI، أو الصق أوامر curl التي تستخدمها في الإنتاج. ضع
DEEPSEEK_API_KEYفي بيئة وقم بالإشارة إليها كـBearer {{DEEPSEEK_API_KEY}}في رأس التخويل (Authorization header). أضف متغيرًا ثانيًا،{{MODEL_ID}}، عيّنه علىdeepseek-v4-pro. - كرر كل طلب باستخدام
deepseek-flash. عيّن{{MODEL_ID}}علىdeepseek-flashفي بيئة ثانية، أو قم بترميز المعرفين بشكل ثابت في الطلبات المقترنة. نفس الاستفسارات، نفس مصفوفة الأدوات، نفسmax_tokens. يجب أن يكون الاختلاف الوحيد هو النموذج. - أضف تأكيدات على شكل JSON وهيكل استدعاء الأداة. بالنسبة للإخراج المنظم، أكد أن
choices[0].message.contentيتم تحليله كـ JSON ويحتوي على المفاتيح التي تتوقعها. بالنسبة لاستدعاء الوظائف، أكد أنchoices[0].message.tool_calls[0].function.nameيساوي الأداة التي تتوقعها وأنargumentsيتم تحليله. هذه الفحوصات تلتقط انحراف التنسيق الصامت. - شغّل الاثنين كسيناريو اختبار واحد. اربط طلبات Pro و Flash في سيناريو واحد بحيث ينتج كل تشغيل تقريرًا واحدًا. قم بتضمين طلب بث مع
stream: true؛ يعرض Apidog أحداث SSE واحدًا تلو الآخر، حتى تتمكن من معرفة ما إذا كانت دلتا الاستدلال والإجابة تصل بالطريقة التي يتوقعها محللك. - قارن النتائج. قارن نصفي التقرير: نسبة نجاح التأكيد، وقت الاستجابة، و
usage.completion_tokens. النموذج الذي يجتاز كل تأكيد ولكنه يصدر رموز إخراج أكثر بنسبة 40% يغير حسابات التكلفة الخاصة بك، وسترى ذلك قبل أن تظهر الفاتورة. - جدولتها في CI باستخدام
apidog-cli. قم بتشغيل السيناريو من مسار عملك يوميًا حتى 14 سبتمبر واستمر في تشغيله بعد ذلك. بمجرد انتهاء Pro، سيعيد النصف الخاص بـ Pro استجابات Flash أيضًا وينهار الاختلاف إلى الصفر: تأكيدًا على حدوث التحويل وأن تأكيداتك لا تزال صالحة.
قم بتنزيل Apidog لإعداد هذا. يعيش سير العمل في مشروع مشترك، بحيث يقرأ مالك الفاتورة ومالك الاستفسارات نفس التقرير.
الأسئلة الشائعة
- هل ستفشل مكالماتي لـ V4-Pro في 14 سبتمبر؟ لا. الطلبات التي تحدد
deepseek-v4-proستُعاد توجيهها إلى V4.1-Flash. ستحصل على استجابة 200 وإجابة من V4.1-Flash. نمط الفشل سيكون سلوكيًا، وليس رمز خطأ. - هل سأُحاسب بأسعار V4-Pro بعد التحويل؟ لا. يتم احتساب الطلبات المعاد توجيهها بأسعار V4.1-Flash: في الذروة، 0.30 دولار بدلاً من 1.32 دولار لكل مليون رمز إدخال بفقدان ذاكرة التخزين المؤقت، و 1.20 دولار بدلاً من 3.96 دولار لكل مليون رمز إخراج.
- هل يجب أن أعيد تسمية المعرف إلى
deepseek-flashأم أبقي علىdeepseek-v4-pro؟ أعد تسميته. الاسم المستعار يعمل، لكن المعرف الصريح يعني أن سجلاتك ولوحات التحكم وتقارير التكلفة الخاصة بك ستوضح ما يتم استدعاؤه. - هل لا يزال إعداد V4-Pro-0813 ساريًا؟ المفتاح، وعنوان URL الأساسي، وشكل الطلب من دليل واجهة برمجة تطبيقات V4-Pro-0813 ينتقلان دون تغيير. ما يتغير هو النموذج الكامن وراءها والتحكم في جهد الاستدلال، لذا أعد الاختبار بدلاً من الافتراض.
- هل V4.1-Flash أسوأ من V4-Pro في أي شيء؟ تُظهر المعايير المنشورة من DeepSeek مكاسب في كل مهمة مدرجة. لم تكن النتائج المستقلة متاحة وقت النشر. تعامل مع "ليس أسوأ في أي شيء" كمطالبة تحتاج إلى اختبار.
أربعة أيام كافية
الترحيل هو تغيير سلسلة واحدة بالإضافة إلى تشغيل اختبار. يستغرق تغيير السلسلة دقيقة واحدة. يخبرك تشغيل الاختبار ما إذا كان النموذج الذي ستدفعه الأسبوع المقبل يتصرف مثل النموذج الذي صممت حوله. أنشئ المجموعة، وشغّلها بينما لا يزال deepseek-v4-pro يشير إلى Pro، واقرأ الاختلاف. إذا كان نظيفًا، فستحصل على فاتورة أرخص بنسبة 70% وخمسة أضعاف التزامن مجانًا. إذا لم يكن كذلك، فقد اكتشفت ذلك في جدولك الزمني، وليس جدول DeepSeek.
