أصبح DeepSeek-V4.1-Flash متاحًا بشكل عام على واجهة برمجة التطبيقات اليوم، 10 سبتمبر 2026. مذكرة الإصدار قصيرة، لكنها تغير ثلاثة أشياء لأي شخص يستدعي واجهة برمجة تطبيقات DeepSeek: يوجد معرّف نموذج واحد للاستخدام من الآن فصاعدًا، وهو deepseek-flash؛ وقد انخفضت الأسعار لكل رمز مميز مرة أخرى؛ وفي غضون أربعة أيام، في 14 سبتمبر، سيتم إعادة توجيه كل طلب إلى deepseek-v4-pro إلى هذا النموذج وسيتم محاسبته بأسعار Flash.
هذه النقطة الأخيرة هي سبب وجود هذا الدليل. إذا كان لديك رمز إنتاجي على V4-Pro، فلن تتمكن من اختيار تاريخ الترحيل. إذا كنت تستخدم V4-Flash، فسيتم خدمتك بالفعل بواسطة النموذج الجديد تحت الاسم القديم. في كلتا الحالتين، تستحق المعلمات التي ترسلها اليوم المراجعة.
تغطي هذه المقالة الجانب العملي: معرف النموذج، عناوين URL الأساسية، أول استدعاء بثلاث لغات، جهد الاستدلال، إدخال الصور، البث، والتسعير. لمعرفة قصة البنية والمعايير، اقرأ أولاً ما هو DeepSeek-V4.1-Flash.
قبل ربط أي شيء بالرمز، ستحتاج إلى طريقة سريعة لإرسال الطلبات ومقارنة الاستجابات. يتعامل Apidog مع ذلك: وجّهه إلى https://api.deepseek.com، وخزّن المفتاح كمتغير، واحفظ كل استدعاء ناجح كاختبار قابل لإعادة التشغيل. سير العمل موجود بالقرب من النهاية.
TL;DR
- معرف النموذج:
deepseek-flash. الأسماء القديمةdeepseek-v4-flashوdeepseek-v4-flash-vision-expلا تزال تعمل ولكنها تحيل إلى V4.1-Flash. - عناوين URL الأساسية لم تتغير:
https://api.deepseek.com(متوافق مع OpenAI) وhttps://api.deepseek.com/anthropic(متوافق مع Anthropic). - يتم إعادة توجيه
deepseek-v4-proإلى V4.1-Flash في 14 سبتمبر 2026 الساعة 04:00 بالتوقيت العالمي المنسق. - سياق 1 مليون رمز مميز، أقصى إخراج 384 ألف، حد التزامن 2,500.
- تسعير خارج أوقات الذروة لكل مليون رمز مميز: 0.003 دولار لضربة ذاكرة التخزين المؤقت، 0.15 دولار لعدم وجود ذاكرة التخزين المؤقت، 0.60 دولار للإخراج. أوقات الذروة هي ضعف ذلك.
- الرؤية مدمجة. توضع الصور في مصفوفة
contentكأجزاءimage_url.
ما الذي تغير لمستدعي واجهة برمجة التطبيقات
إليك الفروق، المستوحاة من مذكرة الإصدار وسجل التغييرات.
معرف نموذج واحد. الاسم الرسمي الآن هو deepseek-flash، بدون رقم إصدار. اربط مطالباتك واختباراتك بالسلوك، وليس بسلسلة إصدار، لأن الإصدار التالي من Flash سيأتي تحت نفس الاسم.
الأسماء القديمة لا تزال تعمل. deepseek-v4-flash و deepseek-v4-flash-vision-exp مقبولة حاليًا، لكن النماذج التي تقف وراءها، V4-Flash و V4-Flash-Vision-Exp، تم إيقافها. يتم تقديم الطلبات لتلك الأسماء بواسطة V4.1-Flash. لا شيء يتعطل، لكنك لا تقوم بتشغيل النموذج الذي تعتقده. أعد التسمية عندما تستطيع.
اسم النسخة التجريبية قد اختفى. النسخة التجريبية التي استمرت ليومين من 8 سبتمبر كانت تعمل تحت اسم deepseek-v4.1-flash-expires-on-0910. لقد انتهت صلاحيتها كما وعدت. انتقل إلى deepseek-flash.
عناوين URL الأساسية والتنسيقات لم تتغير. تتجه الاستدعاءات المتوافقة مع OpenAI إلى https://api.deepseek.com، وتتجه الاستدعاءات المتوافقة مع Anthropic إلى https://api.deepseek.com/anthropic، ويستمر تنسيق واجهة برمجة التطبيقات للاستجابات الذي دعمته سلسلة Flash بالفعل. لا تتغير إعدادات SDK الخاصة بك.
أمام V4-Pro أربعة أيام. اعتبارًا من 14 سبتمبر 2026 الساعة 04:00 بالتوقيت العالمي المنسق (12:00 بتوقيت بكين)، سيتم توجيه كل طلب deepseek-v4-pro إلى V4.1-Flash وسيتم محاسبته بأسعار V4.1-Flash. السبب المعلن من DeepSeek هو أن V4.1-Flash "تجاوزت V4 Pro بشكل شامل في الأداء والتكلفة والسرعة والوقت الإجمالي"، مستشهدة باختبارات من أطراف متعددة. هذا ادعاء من البائع. يوضح دليل ترحيل إيقاف V4-Pro كيفية التحقق من ذلك على مطالباتك الخاصة قبل حدوث التبديل لك.
الخطوة 1: احصل على مفتاح
سجل الدخول إلى منصة DeepSeek، افتح مفاتيح واجهة برمجة التطبيقات (API Keys)، وأنشئ واحدًا. تبدأ المفاتيح بـ sk-. قم بتصديره بدلًا من لصقه في الكود المصدر:
export DEEPSEEK_API_KEY="sk-your-key-here"
لا حاجة إلى SDK خاص بـ DeepSeek. تعمل مكتبات عملاء OpenAI و Anthropic بمجرد تغيير عنوان URL الأساسي.
الخطوة 2: قم بأول استدعاء لك
ابدأ بـ curl، لأنه يزيل كل المتغيرات باستثناء واجهة برمجة التطبيقات نفسها:
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${DEEPSEEK_API_KEY}" \
-d '{
"model": "deepseek-flash",
"messages": [
{"role": "system", "content": "You are a support engineer for a payments API."},
{"role": "user", "content": "A customer gets HTTP 402 on /v1/charges. List the three most likely causes."}
],
"stream": false
}'
نفس الاستدعاء عبر OpenAI Python SDK:
# pip install openai
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DEEPSEEK_API_KEY"],
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-flash",
messages=[
{"role": "system", "content": "You are a support engineer for a payments API."},
{"role": "user", "content": "A customer gets HTTP 402 on /v1/charges. List the three most likely causes."},
],
)
print(response.choices[0].message.content)
و Node:
// npm install openai
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.deepseek.com",
apiKey: process.env.DEEPSEEK_API_KEY,
});
const completion = await client.chat.completions.create({
model: "deepseek-flash",
messages: [
{ role: "user", content: "Write a Postgres migration that adds a nullable refunded_at timestamp to invoices." },
],
});
console.log(completion.choices[0].message.content);
إذا قمت بالإعداد مقابل الإصدار السابق باتباع دليل V4-Flash API، فإن الاختلاف الوحيد هو سلسلة النموذج.
الخطوة 3: جهد الاستدلال ووضع التفكير
تصف بطاقة النموذج جهد الاستدلال بأنه "قابل للتحكم بشكل مستمر" على مقياس من 1 إلى 100. هذا يختلف عن الإعدادات المسبقة المنخفضة/المتوسطة/العالية التي تكشفها معظم واجهات برمجة التطبيقات، ويعني أنه يمكنك ضبط التكلفة ووقت الاستجابة لكل نقطة نهاية بدلاً من كل مستوى.
شكل المعامل الذي يحمل هذه القيمة من 1 إلى 100 هو [تحقق] مقابل وثائق واجهة برمجة التطبيقات. حتى يتم تأكيد ذلك، ابدأ من نمط V4-Flash: reasoning_effort بالإضافة إلى كائن thinking يتم تمريره عبر extra_body:
response = client.chat.completions.create(
model="deepseek-flash",
messages=[{"role": "user", "content": "Our Redis cluster drops 2% of SETs under load. Plan the investigation."}],
reasoning_effort="high",
extra_body={"thinking": {"type": "enabled"}},
)
إعدادات أخذ العينات الموصى بها من بطاقة النموذج: temperature 1.0، top_p 0.95 أو 1.0، وmax_tokens بقيمة 256 ألف أو أكثر لتتبعات الاستدلال الطويلة. الحد الأقصى للإخراج هو 384 ألف رمز مميز.
تقسيم عملي: إيقاف التفكير للاكمال التلقائي والتصنيف وأي شيء ينتظره المستخدم؛ تشغيل التفكير بجهد عالٍ لحلقات الوكيل، وإعادة هيكلة الملفات المتعددة، وتصحيح الأخطاء. ثم قم بالقياس. الجهد الذي لا يمكنك رؤيته في المخرجات هو جهد تدفع ثمنه على أي حال.
الخطوة 4: إرسال صورة
V4.1-Flash متعدد الوسائط بشكل أصيل، تم تدريبه على مجموعة بيانات متعددة الوسائط بحجم 45 تريليون رمز مميز مع مشفر DeepSeek-ViT تم تدريبه من الصفر. تنسيق الطلب ينتقل من V4-Flash-Vision-Exp: الصور هي أجزاء من مصفوفة content لرسالة المستخدم.
response = client.chat.completions.create(
model="deepseek-flash",
messages=[{
"role": "user",
"content": [
{"type": "text", "text": "Extract every line item and the total from this receipt as JSON."},
{"type": "image_url", "image_url": {"url": "https://cdn.example-shop.com/receipts/48213.png"}},
],
}],
)
للملف المحلي، قم بترميزه كعنوان URL للبيانات بترميز base64:
import base64
with open("receipt.png", "rb") as f:
data_url = "data:image/png;base64," + base64.b64encode(f.read()).decode()
# then pass {"url": data_url} in the image_url part
الحدود: عناوين URL للبيانات بترميز base64 تصل إلى 32 ميجابايت، وعناوين URL الخارجية تصل إلى 8,192 حرفًا، أو معرف ملف. يتم قبول حقل detail اختياري. تشير DeepSeek إلى DocVQA 95.6، وهي حالة قراءة المستندات المذكورة أعلاه. يغطي دليل واجهة برمجة التطبيقات للرؤية المطالبات متعددة الصور، ومستويات التفاصيل، وتكلفة الصور لكل طلب.
الخطوة 5: بث الاستجابة
اضبط stream=True وستعيد نقطة النهاية أحداثًا مرسلة من الخادم. يصل محتوى الاستدلال ومحتوى الإجابة كتغييرات منفصلة، وهو أمر مهم عند عرض حالة "التفكير" في واجهة المستخدم.
stream = client.chat.completions.create(
model="deepseek-flash",
messages=[{"role": "user", "content": "Explain idempotency keys in one paragraph."}],
stream=True,
)
for chunk in stream:
delta = chunk.choices[0].delta
if delta.content:
print(delta.content, end="", flush=True)
إذا كانت SSE جديدة عليك، فإن بث استجابات LLM باستخدام أحداث مرسلة من الخادم يشرح تنسيق الاتصال وحالات الحافة لإعادة الاتصال.
التسعير في لمحة
من صفحة التسعير الرسمية، اعتبارًا من 10 سبتمبر 2026 الساعة 04:00 بالتوقيت العالمي المنسق، بالدولار الأمريكي لكل مليون رمز مميز:
| deepseek-flash خارج أوقات الذروة | deepseek-flash أوقات الذروة | |
|---|---|---|
| الإدخال، ضربة ذاكرة التخزين المؤقت | $0.003 | $0.006 |
| الإدخال، عدم وجود ذاكرة التخزين المؤقت | $0.15 | $0.30 |
| الإخراج | $0.60 | $1.20 |
ثلاثة أمور يجب معرفتها:
- فترات الذروة هي من الاثنين إلى الجمعة، من الساعة 01:00 إلى 04:00 ومن 06:00 إلى 10:00 بالتوقيت العالمي المنسق (09:00 إلى 12:00 ومن 14:00 إلى 18:00 بتوقيت بكين). خارج أوقات الذروة يكون السعر نصفًا. يجب على المهام الدفعية التي يمكن أن تنتظر أن تنتظر.
- ضربات ذاكرة التخزين المؤقت تلقائية. تكلف الضربة 50 مرة أقل من عدم وجودها، لذا فإن مطالبة نظام مستقرة في بداية كل طلب هي أرخص تحسين متاح. ما هو التخزين المؤقت للمطالبات يشرح كيفية عمل مطابقة البادئة.
- مقارنة بـ V4-Flash، يبلغ التخفيض حوالي 57% على إدخال ضربات ذاكرة التخزين المؤقت، و32% على إدخال عدم وجود ذاكرة التخزين المؤقت، و9% على الإخراج. يدفع عبء عمل V4-Pro الذي تم إعادة توجيهه في 14 سبتمبر 0.30 دولار بدلاً من 1.32 دولار لكل مليون إدخال غير موجود في ذاكرة التخزين المؤقت في أوقات الذروة، و1.20 دولار بدلاً من 3.96 دولار للإخراج.
اختبر واجهة برمجة التطبيقات في Apidog
بمجرد أن ينجح الاستدعاء الأول، السؤال هو ما إذا كان سيستمر في العمل. deepseek-flash لا يحمل أي إصدار، لذا فإن الترقية التالية ستكون صامتة. إليك سير عمل Apidog الذي يلتقط ذلك:

- أضف نقطة النهاية. أنشئ
POST https://api.deepseek.com/chat/completions، أو استورد مواصفات OpenAPI متوافقة مع OpenAI بحيث تصل كل المسارات دفعة واحدة. - خزّن المفتاح كمتغير بيئة. ضع
DEEPSEEK_API_KEYفي بيئة Apidog واضبط الرأس علىBearer {{DEEPSEEK_API_KEY}}. يصبح التبديل بين المفتاح الشخصي ومفتاح الإنتاج قائمة منسدلة. - احفظ طلبًا واحدًا لكل مستوى جهد. كرر الطلب الأساسي في متغيرات: التفكير معطل، التفكير مفعل بجهد منخفض، التفكير مفعل بجهد عالٍ. نفس المطالبة، معلمات مختلفة. أرسل الثلاثة وقارن استخدام الرمز المميز ووقت الاستجابة جنبًا إلى جنب.
- راقب البث. بالنسبة لـ
stream: true، يعرض Apidog أحداث SSE فور وصولها، لذا تظهر دلتا الاستدلال ودلتا المحتوى كخطوط منفصلة بدلاً من جدار من بادئاتdata:. - حوّل المتغيرات إلى سيناريو اختبار. أضف تأكيدات على رمز الحالة، وعلى عدد مرات تكرار ذاكرة التخزين المؤقت في
usageليكون أكبر من الصفر في التشغيل الثاني، وعلى الاستجابة التي تحتوي على الحقول التي يحللها تطبيقك. أعد تشغيل السيناريو بعد كل تحديث للنموذج، وفي 14 سبتمبر عندما يصبح تحويل V4-Pro مباشرًا. - شغّله في CI (التكامل المستمر). ينفذ
apidog-cliنفس السيناريو من خط أنابيب، لذا فإن التغيير الصامت للنموذج يؤدي إلى فشل البناء بدلاً من التأثير على العميل.
قم بتنزيل Apidog ويستغرق الإعداد بالكامل حوالي عشر دقائق.
الأسئلة الشائعة
- هل يجب علي إعادة تسمية
deepseek-v4-flashإلىdeepseek-flash؟ ليس اليوم. الاسم القديم لا يزال يوجه إلى V4.1-Flash. لكن V4-Flash نفسه تم إيقافه، ولم تذكر DeepSeek متى سيختفي الاسم المستعار. أعد التسمية في نشرك التالي. - ماذا سيحدث لرمز V4-Pro الخاص بي في 14 سبتمبر؟ لا شيء سيتعطل. ستتم الإجابة على الطلبات الموجهة إلى
deepseek-v4-proبواسطة V4.1-Flash وستتم محاسبتها بأسعار Flash اعتبارًا من الساعة 04:00 بالتوقيت العالمي المنسق. قد تتغير مخرجاتك، لذا قم بتشغيل مجموعة التقييم الخاصة بك قبل ذلك التاريخ. يحتوي دليل الترحيل على قائمة تحقق. - هل تدعم نقطة النهاية المتوافقة مع Anthropic النموذج الجديد؟ نعم.
https://api.deepseek.com/anthropicلم يتغير؛ استخدمdeepseek-flashكاسم للنموذج هناك أيضًا. - هل هناك طبقة مجانية؟ واجهة برمجة التطبيقات هي نظام الدفع حسب الاستخدام بدون طبقة مجانية دائمة. الأوزان مرخصة بموجب ترخيص MIT على Hugging Face إذا كنت ترغب في استضافتها بنفسك. تم جمع الخيارات الحالية في كيفية استخدام DeepSeek V4 API مجانًا.
- ما مدى سرعته؟ لم تنشر DeepSeek رقمًا لعدد الرموز المميزة في الثانية. أبلغ أحد مستخدمي X عن "ما يقرب من 400 رمز مميز/ثانية" في اختبارات الفيديو، وهي حكاية وليست مواصفات. قم بالقياس على مطالباتك الخاصة خلال فترة الذروة.
قبل إعادة التوجيه
لم يتغير سطح واجهة برمجة التطبيقات كثيرًا: نفس عناوين URL الأساسية، نفس تنسيق الطلب، معرف نموذج جديد واحد. ما تغير هو السعر، وفي 14 سبتمبر، سيتم إعادة توجيه كل استدعاء V4-Pro. أعد تسمية deepseek-v4-flash إلى deepseek-flash، اختر مستوى جهد لكل نقطة نهاية، وقم بتشغيل مطالباتك عبر النموذج الجديد قبل أن تفعل DeepSeek ذلك بالنيابة عنك.
احفظ تلك المطالبات كاختبارات أثناء قيامك بذلك. Apidog يعيد تشغيلها بنقرة واحدة، وستظهر ترقية Flash الصامتة التالية كتأكيد فاشل بدلاً من تذكرة دعم.
