كيفية استخدام DeepSeek-V4.1-Flash API؟

استدعاء واجهة برمجة تطبيقات DeepSeek-V4.1-Flash: معرف النموذج deepseek-flash، عناوين URL الأساسية، أول استدعاء في curl/بايثون/Node، جهد الاستدلال، إدخال الصور، التدفق، التسعير.

INEZA Felin-Michel

INEZA Felin-Michel

10 سبتمبر 2026

كيفية استخدام DeepSeek-V4.1-Flash API؟

Apidog للمؤسسات

النشر على الخوادم المحلية

SSO و RBAC

متوافق مع SOC 2

استكشف Apidog للمؤسسات

أصبح DeepSeek-V4.1-Flash متاحًا بشكل عام على واجهة برمجة التطبيقات اليوم، 10 سبتمبر 2026. مذكرة الإصدار قصيرة، لكنها تغير ثلاثة أشياء لأي شخص يستدعي واجهة برمجة تطبيقات DeepSeek: يوجد معرّف نموذج واحد للاستخدام من الآن فصاعدًا، وهو deepseek-flash؛ وقد انخفضت الأسعار لكل رمز مميز مرة أخرى؛ وفي غضون أربعة أيام، في 14 سبتمبر، سيتم إعادة توجيه كل طلب إلى deepseek-v4-pro إلى هذا النموذج وسيتم محاسبته بأسعار Flash.

هذه النقطة الأخيرة هي سبب وجود هذا الدليل. إذا كان لديك رمز إنتاجي على V4-Pro، فلن تتمكن من اختيار تاريخ الترحيل. إذا كنت تستخدم V4-Flash، فسيتم خدمتك بالفعل بواسطة النموذج الجديد تحت الاسم القديم. في كلتا الحالتين، تستحق المعلمات التي ترسلها اليوم المراجعة.

تغطي هذه المقالة الجانب العملي: معرف النموذج، عناوين URL الأساسية، أول استدعاء بثلاث لغات، جهد الاستدلال، إدخال الصور، البث، والتسعير. لمعرفة قصة البنية والمعايير، اقرأ أولاً ما هو DeepSeek-V4.1-Flash.

قبل ربط أي شيء بالرمز، ستحتاج إلى طريقة سريعة لإرسال الطلبات ومقارنة الاستجابات. يتعامل Apidog مع ذلك: وجّهه إلى https://api.deepseek.com، وخزّن المفتاح كمتغير، واحفظ كل استدعاء ناجح كاختبار قابل لإعادة التشغيل. سير العمل موجود بالقرب من النهاية.

زر

TL;DR

ما الذي تغير لمستدعي واجهة برمجة التطبيقات

إليك الفروق، المستوحاة من مذكرة الإصدار وسجل التغييرات.

معرف نموذج واحد. الاسم الرسمي الآن هو deepseek-flash، بدون رقم إصدار. اربط مطالباتك واختباراتك بالسلوك، وليس بسلسلة إصدار، لأن الإصدار التالي من Flash سيأتي تحت نفس الاسم.

الأسماء القديمة لا تزال تعمل. deepseek-v4-flash و deepseek-v4-flash-vision-exp مقبولة حاليًا، لكن النماذج التي تقف وراءها، V4-Flash و V4-Flash-Vision-Exp، تم إيقافها. يتم تقديم الطلبات لتلك الأسماء بواسطة V4.1-Flash. لا شيء يتعطل، لكنك لا تقوم بتشغيل النموذج الذي تعتقده. أعد التسمية عندما تستطيع.

اسم النسخة التجريبية قد اختفى. النسخة التجريبية التي استمرت ليومين من 8 سبتمبر كانت تعمل تحت اسم deepseek-v4.1-flash-expires-on-0910. لقد انتهت صلاحيتها كما وعدت. انتقل إلى deepseek-flash.

عناوين URL الأساسية والتنسيقات لم تتغير. تتجه الاستدعاءات المتوافقة مع OpenAI إلى https://api.deepseek.com، وتتجه الاستدعاءات المتوافقة مع Anthropic إلى https://api.deepseek.com/anthropic، ويستمر تنسيق واجهة برمجة التطبيقات للاستجابات الذي دعمته سلسلة Flash بالفعل. لا تتغير إعدادات SDK الخاصة بك.

أمام V4-Pro أربعة أيام. اعتبارًا من 14 سبتمبر 2026 الساعة 04:00 بالتوقيت العالمي المنسق (12:00 بتوقيت بكين)، سيتم توجيه كل طلب deepseek-v4-pro إلى V4.1-Flash وسيتم محاسبته بأسعار V4.1-Flash. السبب المعلن من DeepSeek هو أن V4.1-Flash "تجاوزت V4 Pro بشكل شامل في الأداء والتكلفة والسرعة والوقت الإجمالي"، مستشهدة باختبارات من أطراف متعددة. هذا ادعاء من البائع. يوضح دليل ترحيل إيقاف V4-Pro كيفية التحقق من ذلك على مطالباتك الخاصة قبل حدوث التبديل لك.

الخطوة 1: احصل على مفتاح

سجل الدخول إلى منصة DeepSeek، افتح مفاتيح واجهة برمجة التطبيقات (API Keys)، وأنشئ واحدًا. تبدأ المفاتيح بـ sk-. قم بتصديره بدلًا من لصقه في الكود المصدر:

export DEEPSEEK_API_KEY="sk-your-key-here"

لا حاجة إلى SDK خاص بـ DeepSeek. تعمل مكتبات عملاء OpenAI و Anthropic بمجرد تغيير عنوان URL الأساسي.

الخطوة 2: قم بأول استدعاء لك

ابدأ بـ curl، لأنه يزيل كل المتغيرات باستثناء واجهة برمجة التطبيقات نفسها:

curl https://api.deepseek.com/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${DEEPSEEK_API_KEY}" \
  -d '{
    "model": "deepseek-flash",
    "messages": [
      {"role": "system", "content": "You are a support engineer for a payments API."},
      {"role": "user", "content": "A customer gets HTTP 402 on /v1/charges. List the three most likely causes."}
    ],
    "stream": false
  }'

نفس الاستدعاء عبر OpenAI Python SDK:

# pip install openai
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["DEEPSEEK_API_KEY"],
    base_url="https://api.deepseek.com",
)

response = client.chat.completions.create(
    model="deepseek-flash",
    messages=[
        {"role": "system", "content": "You are a support engineer for a payments API."},
        {"role": "user", "content": "A customer gets HTTP 402 on /v1/charges. List the three most likely causes."},
    ],
)

print(response.choices[0].message.content)

و Node:

// npm install openai
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.deepseek.com",
  apiKey: process.env.DEEPSEEK_API_KEY,
});

const completion = await client.chat.completions.create({
  model: "deepseek-flash",
  messages: [
    { role: "user", content: "Write a Postgres migration that adds a nullable refunded_at timestamp to invoices." },
  ],
});

console.log(completion.choices[0].message.content);

إذا قمت بالإعداد مقابل الإصدار السابق باتباع دليل V4-Flash API، فإن الاختلاف الوحيد هو سلسلة النموذج.

الخطوة 3: جهد الاستدلال ووضع التفكير

تصف بطاقة النموذج جهد الاستدلال بأنه "قابل للتحكم بشكل مستمر" على مقياس من 1 إلى 100. هذا يختلف عن الإعدادات المسبقة المنخفضة/المتوسطة/العالية التي تكشفها معظم واجهات برمجة التطبيقات، ويعني أنه يمكنك ضبط التكلفة ووقت الاستجابة لكل نقطة نهاية بدلاً من كل مستوى.

شكل المعامل الذي يحمل هذه القيمة من 1 إلى 100 هو [تحقق] مقابل وثائق واجهة برمجة التطبيقات. حتى يتم تأكيد ذلك، ابدأ من نمط V4-Flash: reasoning_effort بالإضافة إلى كائن thinking يتم تمريره عبر extra_body:

response = client.chat.completions.create(
    model="deepseek-flash",
    messages=[{"role": "user", "content": "Our Redis cluster drops 2% of SETs under load. Plan the investigation."}],
    reasoning_effort="high",
    extra_body={"thinking": {"type": "enabled"}},
)

إعدادات أخذ العينات الموصى بها من بطاقة النموذج: temperature 1.0، top_p 0.95 أو 1.0، وmax_tokens بقيمة 256 ألف أو أكثر لتتبعات الاستدلال الطويلة. الحد الأقصى للإخراج هو 384 ألف رمز مميز.

تقسيم عملي: إيقاف التفكير للاكمال التلقائي والتصنيف وأي شيء ينتظره المستخدم؛ تشغيل التفكير بجهد عالٍ لحلقات الوكيل، وإعادة هيكلة الملفات المتعددة، وتصحيح الأخطاء. ثم قم بالقياس. الجهد الذي لا يمكنك رؤيته في المخرجات هو جهد تدفع ثمنه على أي حال.

الخطوة 4: إرسال صورة

V4.1-Flash متعدد الوسائط بشكل أصيل، تم تدريبه على مجموعة بيانات متعددة الوسائط بحجم 45 تريليون رمز مميز مع مشفر DeepSeek-ViT تم تدريبه من الصفر. تنسيق الطلب ينتقل من V4-Flash-Vision-Exp: الصور هي أجزاء من مصفوفة content لرسالة المستخدم.

response = client.chat.completions.create(
    model="deepseek-flash",
    messages=[{
        "role": "user",
        "content": [
            {"type": "text", "text": "Extract every line item and the total from this receipt as JSON."},
            {"type": "image_url", "image_url": {"url": "https://cdn.example-shop.com/receipts/48213.png"}},
        ],
    }],
)

للملف المحلي، قم بترميزه كعنوان URL للبيانات بترميز base64:

import base64

with open("receipt.png", "rb") as f:
    data_url = "data:image/png;base64," + base64.b64encode(f.read()).decode()

# then pass {"url": data_url} in the image_url part

الحدود: عناوين URL للبيانات بترميز base64 تصل إلى 32 ميجابايت، وعناوين URL الخارجية تصل إلى 8,192 حرفًا، أو معرف ملف. يتم قبول حقل detail اختياري. تشير DeepSeek إلى DocVQA 95.6، وهي حالة قراءة المستندات المذكورة أعلاه. يغطي دليل واجهة برمجة التطبيقات للرؤية المطالبات متعددة الصور، ومستويات التفاصيل، وتكلفة الصور لكل طلب.

الخطوة 5: بث الاستجابة

اضبط stream=True وستعيد نقطة النهاية أحداثًا مرسلة من الخادم. يصل محتوى الاستدلال ومحتوى الإجابة كتغييرات منفصلة، وهو أمر مهم عند عرض حالة "التفكير" في واجهة المستخدم.

stream = client.chat.completions.create(
    model="deepseek-flash",
    messages=[{"role": "user", "content": "Explain idempotency keys in one paragraph."}],
    stream=True,
)

for chunk in stream:
    delta = chunk.choices[0].delta
    if delta.content:
        print(delta.content, end="", flush=True)

إذا كانت SSE جديدة عليك، فإن بث استجابات LLM باستخدام أحداث مرسلة من الخادم يشرح تنسيق الاتصال وحالات الحافة لإعادة الاتصال.

التسعير في لمحة

من صفحة التسعير الرسمية، اعتبارًا من 10 سبتمبر 2026 الساعة 04:00 بالتوقيت العالمي المنسق، بالدولار الأمريكي لكل مليون رمز مميز:

deepseek-flash خارج أوقات الذروة deepseek-flash أوقات الذروة
الإدخال، ضربة ذاكرة التخزين المؤقت $0.003 $0.006
الإدخال، عدم وجود ذاكرة التخزين المؤقت $0.15 $0.30
الإخراج $0.60 $1.20

ثلاثة أمور يجب معرفتها:

اختبر واجهة برمجة التطبيقات في Apidog

بمجرد أن ينجح الاستدعاء الأول، السؤال هو ما إذا كان سيستمر في العمل. deepseek-flash لا يحمل أي إصدار، لذا فإن الترقية التالية ستكون صامتة. إليك سير عمل Apidog الذي يلتقط ذلك:

  1. أضف نقطة النهاية. أنشئ POST https://api.deepseek.com/chat/completions، أو استورد مواصفات OpenAPI متوافقة مع OpenAI بحيث تصل كل المسارات دفعة واحدة.
  2. خزّن المفتاح كمتغير بيئة. ضع DEEPSEEK_API_KEY في بيئة Apidog واضبط الرأس على Bearer {{DEEPSEEK_API_KEY}}. يصبح التبديل بين المفتاح الشخصي ومفتاح الإنتاج قائمة منسدلة.
  3. احفظ طلبًا واحدًا لكل مستوى جهد. كرر الطلب الأساسي في متغيرات: التفكير معطل، التفكير مفعل بجهد منخفض، التفكير مفعل بجهد عالٍ. نفس المطالبة، معلمات مختلفة. أرسل الثلاثة وقارن استخدام الرمز المميز ووقت الاستجابة جنبًا إلى جنب.
  4. راقب البث. بالنسبة لـ stream: true، يعرض Apidog أحداث SSE فور وصولها، لذا تظهر دلتا الاستدلال ودلتا المحتوى كخطوط منفصلة بدلاً من جدار من بادئات data:.
  5. حوّل المتغيرات إلى سيناريو اختبار. أضف تأكيدات على رمز الحالة، وعلى عدد مرات تكرار ذاكرة التخزين المؤقت في usage ليكون أكبر من الصفر في التشغيل الثاني، وعلى الاستجابة التي تحتوي على الحقول التي يحللها تطبيقك. أعد تشغيل السيناريو بعد كل تحديث للنموذج، وفي 14 سبتمبر عندما يصبح تحويل V4-Pro مباشرًا.
  6. شغّله في CI (التكامل المستمر). ينفذ apidog-cli نفس السيناريو من خط أنابيب، لذا فإن التغيير الصامت للنموذج يؤدي إلى فشل البناء بدلاً من التأثير على العميل.

قم بتنزيل Apidog ويستغرق الإعداد بالكامل حوالي عشر دقائق.

الأسئلة الشائعة

قبل إعادة التوجيه

لم يتغير سطح واجهة برمجة التطبيقات كثيرًا: نفس عناوين URL الأساسية، نفس تنسيق الطلب، معرف نموذج جديد واحد. ما تغير هو السعر، وفي 14 سبتمبر، سيتم إعادة توجيه كل استدعاء V4-Pro. أعد تسمية deepseek-v4-flash إلى deepseek-flash، اختر مستوى جهد لكل نقطة نهاية، وقم بتشغيل مطالباتك عبر النموذج الجديد قبل أن تفعل DeepSeek ذلك بالنيابة عنك.

احفظ تلك المطالبات كاختبارات أثناء قيامك بذلك. Apidog يعيد تشغيلها بنقرة واحدة، وستظهر ترقية Flash الصامتة التالية كتأكيد فاشل بدلاً من تذكرة دعم.

ممارسة تصميم API في Apidog

اكتشف طريقة أسهل لبناء واستخدام واجهات برمجة التطبيقات