أسعار Qwen 3.8 مشروحة: $2 للإدخال / $6 للإخراج لسياق 1 مليون توكن

أسعار كوين 3.8 عند الإطلاق العام: 2 دولار للمدخلات / 6 دولارات للمخرجات لكل مليون رمز مميز، ثابتة على امتداد سياق المليون رمز مميز بالكامل. خصومات التخزين المؤقت، التفاصيل الدقيقة للحصة المجانية، وحسابات التكلفة المفصلة.

INEZA Felin-Michel

INEZA Felin-Michel

3 أغسطس 2026

أسعار Qwen 3.8 مشروحة: $2 للإدخال / $6 للإخراج لسياق 1 مليون توكن

Apidog للمؤسسات

النشر على الخوادم المحلية

SSO و RBAC

متوافق مع SOC 2

استكشف Apidog للمؤسسات

أطلقت علي بابا نموذج Qwen 3.8-Max في أوائل أغسطس 2026، وأخيراً أصبح لسؤال التسعير إجابة حقيقية. خلال فترة المعاينة في يوليو، كانت القصة المتداولة هي عرض "تسعير المعاينة بخصم 10%". تلك القصة انتهت. عند التوفر العام، تُدرج صفحة أسعار Model Studio الرسمية نموذج qwen3.8-max بسعر 2 دولار لكل مليون توكن إدخال و6 دولارات لكل مليون توكن إخراج، في طبقة سعرية واحدة ثابتة تغطي نافذة السياق الكاملة التي تبلغ مليون توكن.

هذه الطبقة السعرية الثابتة هي الجزء المثير للاهتمام. معظم النماذج الرائدة تفرض رسومًا أعلى لكل توكن بمجرد أن يتجاوز موجهك عتبة سياقية معينة. Qwen 3.8-Max لا يفعل ذلك: أرسل 5,000 توكن أو 900,000 توكن، يظل السعر 2 دولار / 6 دولارات.

تغطي هذه المقالة الصورة الكاملة: تصميم الطبقة السعرية الثابتة، والمقارنات مع Qwen 3.7-Max وKimi K3 وClaude Opus 5 وGPT-5.6 Terra، وخصومات التخزين المؤقت، والشروط الدقيقة للحصة المجانية، وأمثلة التكلفة العملية مع حسابات حقيقية. للحصول على نظرة عامة أوسع عن النموذج، ابدأ بـ ما هو Qwen 3.8 ولماذا هو مهم، ثم عد للحصول على الأرقام.

ملاحظة أولى: الأسعار المعلنة تعطيك تقديرًا فقط. يأتي Qwen 3.8-Max مزودًا بآلية استدلال بمجهود xhigh افتراضيًا، ويتم احتساب توكنات التفكير كإخراج. الطريقة الموثوقة لتوقع التكاليف هي إرسال طلبات حقيقية وقياس استخدام التوكنات. يعرض Apidog تفصيلاً كاملاً لتوكنات كل استجابة أثناء الاختبار، مما يحول تقدير التكلفة إلى عملية حسابية. المزيد حول هذا أدناه.

الرقم المعلن للتوفر العام: 2 دولار للإدخال، 6 دولارات للإخراج، طبقة سعرية واحدة

إليك بطاقة الأسعار الرسمية لنموذج qwen3.8-max، تم التحقق منها مقابل صفحة تسعير Model Studio اعتبارًا من 3 أغسطس 2026:

العنصر السعر (لكل مليون توكن)
الإدخال $2.00
الإخراج (بما في ذلك توكنات التفكير) $6.00
الإدخال المخزن مؤقتًا (إصابة الذاكرة المؤقتة) 10% من سعر الإدخال
إنشاء ذاكرة مؤقتة صريح 125% من سعر الإدخال
طبقة السياق طبقة واحدة، من 0 إلى مليون توكن
التفكير مقابل عدم التفكير يتم احتسابها بنفس السعر

ثلاثة تفاصيل تستحق الإشارة إليها: نافذة السياق التي تبلغ مليون توكن مغطاة بالكامل بسعر واحد، بدون رسوم إضافية على الموجهات الطويلة. تكلف أوضاع التفكير وعدم التفكير نفس الأسعار، على الرغم من أن توكنات التفكير تُحتسب كإخراج (انظر قسم الصدق أدناه). والحد الأقصى للإخراج هو 65,536 توكنًا لكل طلب، لذا يبلغ الحد الأقصى لفاتورة الاستجابة الواحدة حوالي 0.39 دولارًا كإخراج.

يعتبر الإعلان الرسمي عن Qwen 3.8 النموذج الأكثر قدرة من علي بابا حتى الآن: 2.4 تريليون معلمة إجمالية مع 95 مليار معلمة نشطة، نافذة سياق بمليون توكن، إدخال متعدد الوسائط. الحصول على ذلك بسعر 2 دولار / 6 دولارات يقلل من تكلفة معظم الفئة الرائدة، بما في ذلك النموذج الرائد السابق لشركة علي بابا نفسها.

لماذا يعد التسعير الثابت عبر مليون توكن أمراً غير معتاد

التسعير المتدرج للسياق هو القاعدة الصناعية: سعر واحد أقل من عتبة سياقية، وسعر أعلى فوقها، لأن السياقات الطويلة تكلف أكثر في الخدمة.

تفعل علي بابا ذلك بنفسها. على نفس صفحة تسعير Model Studio، يتم تسعير نماذج مثل qwen3-max وqwen3-coder-plus في طبقات طول السياق، مع زيادة سعر التوكن كلما زاد الإدخال. يكسر Qwen 3.8-Max هذا النمط ضمن كتالوج علي بابا الخاص: يظهر جدول أسعاره صفًا واحدًا، "0<توكن≤1 مليون"، وهذا كل ما في الأمر.

لماذا هذا مهم: مع التسعير المتدرج، تحمل أعباء العمل ذات السياقات الطويلة مضاعفًا خفيًا. يمكن لخط أنابيب RAG الذي يملأ أحيانًا 300 ألف توكن من المستندات في موجه أن يكلف عدة أضعاف سعره النموذجي على تلك الطلبات. مع Qwen 3.8-Max، يكلف التوكن الهامشي دائمًا نفس السعر، لذا فإن الميزانية خطية: التوكنات مضروبة في السعر، انتهى. لتحليل المستندات الطويلة، أو وكلاء قواعد البيانات الكبيرة، أو خطوط أنابيب الاسترجاع الثقيلة، فإن هذه القدرة على التنبؤ تساوي قيمة السعر المنخفض نفسه.

أرخص من Qwen 3.7-Max بالسعر المعلن

تم إطلاق Qwen 3.8-Max بسعر أقل من السعر المعلن لسابقه، وهو أمر نادر بالنسبة لقفزة جيل رائد:

هذا تخفيض بنسبة 20% على كلا الجانبين بينما اكتسب النموذج نافذة سياق أكبر، وإدخال متعدد الوسائط، ونتائج معيارية أفضل.

أحد التعقيدات: يجري Qwen 3.7-Max حاليًا عرضًا ترويجيًا بخصم 50%، مما يقلل سعره إلى 1.25 دولار / 3.75 دولار. بأسعار العروض الترويجية، يعتبر النموذج الرائد الأقدم أرخص من الجديد. إذا كانت حمولة عملك لا تحتاج إلى سياق مليون توكن لـ Qwen 3.8 أو مكاسبه متعددة الوسائط والوكيلة، فإن 3.7-Max المخفض هو خيار ذو قيمة حقيقية طالما استمر العرض الترويجي؛ فقط لا تبنِ نموذج التكلفة الخاص بك حول عرض ترويجي. كلما نزلنا في السلسلة، يظل Qwen 3.7-Plus هو الحل العملي الميسور التكلفة بسعر 0.4 دولار / 1.6 دولار، مع عرض ترويجي خاص به بخصم 20%.

قسم الصراحة: تُحسب توكنات التفكير كإخراج

هذا هو الجزء الذي تتجاهله معظم كتابات التسعير، والجزء الأكثر احتمالًا لمفاجأتك في الفاتورة.

يدعم Qwen 3.8-Max معلمة reasoning_effort بثلاثة مستويات: xhigh، medium، وlow. الافتراضي هو xhigh، وهو الإعداد الأكثر قوة. في وضع التفكير، يُولّد النموذج توكنات استدلال داخلية قبل إجابته النهائية، وتُحسب توكنات الاستدلال هذه بسعر إخراج 6 دولارات، تمامًا مثل النص المرئي.

النتيجة: في الإعدادات الافتراضية، تكلف الطلبات التي تتطلب استدلالًا كبيرًا أكثر مما يتوقعه تقدير "توكنات الموجه زائد توكنات الإجابة" الساذج. قد تكون الاستجابة التي تعرض 800 توكن من الإجابة المرئية قد استهلكت عدة آلاف من توكنات التفكير في مشكلة صعبة.

ثلاثة تدابير للتخفيف: خفض reasoning_effort إلى medium أو low للمهام التي لا تتطلب استدلالًا عميقًا (التصنيف، الاستخراج، التنسيق)؛ قياس الاستخدام الفعلي لكل نوع مهمة قبل توقع الإنفاق الشهري، نظرًا لأن كائن usage في كل استجابة يُبلغ عن الأعداد الحقيقية بما في ذلك الاستدلال؛ ومراقبة توكنات الإخراج بشكل خاص، لأن الإخراج هنا يكلف 3 أضعاف الإدخال والتفكير يزيد من الإخراج.

التخزين المؤقت للسياق: 10% للإصابات، 125% للإنشاء

إذا كان تطبيقك يعيد إرسال نفس بادئة الموجه بشكل متكرر (موجه نظام طويل، مستند ثابت، تعريفات أدوات)، فإن التخزين المؤقت للسياق يغير الجدوى الاقتصادية بشكل كبير:

حساب نقطة التعادل بسيط. يكلف الإنشاء 25% إضافية لمرة واحدة؛ كل إصابة لاحقة توفر 90%. إذا تم إعادة استخدام بادئة مرتين فقط، فإن التخزين المؤقت يسدد تكاليفه بالفعل. بالنسبة للوكلاء ذوي التردد العالي أو تطبيقات الدردشة ذات موجه النظام الثقيل، تتضاعف المدخرات بسرعة (مثال عملي أدناه).

تفاصيل الحصة المجانية: مليون توكن، سنغافورة، 90 يومًا

يوفر Model Studio حصة مجانية لـ qwen3.8-max، والتفاصيل الدقيقة مهمة:

تُسحب توكنات التفكير من هذه الحصة مثل أي إخراج آخر، لذا فإن بضع عشرات من مهام الاستدلال الصعبة بمستوى xhigh يمكن أن تستنزف مليون توكن أسرع مما تتوقع. إذا كان الوصول المجاني هو هدفك الرئيسي، فقد جمعنا جميع الطرق المجانية، بما في ذلك Qwen Chat، في كيفية استخدام Qwen 3.8 مجانًا.

كيف تقارن أسعار Qwen 3.8

إليك المشهد الحالي، باستخدام الأسعار المعلنة لكل مليون توكن. يتم الإشارة إلى الأسعار الترويجية، لأن العروض تنتهي صلاحيتها.

النموذج الإدخال الإخراج ملاحظات
Qwen 3.8-Max $2.00 $6.00 ثابت عبر سياق مليون توكن؛ إصابات الذاكرة المؤقتة 10%
Qwen 3.7-Max $2.50 $7.50 حاليا بخصم 50%: 1.25 دولار / 3.75 دولار (عرض ترويجي)
Qwen 3.7-Plus $0.40 $1.60 حاليا بخصم 20% (عرض ترويجي)
Kimi K3 $3.00 $15.00 إصابات الذاكرة المؤقتة 0.30 دولار
Claude Opus 5 $5.00 $25.00
GPT-5.6 Terra $2.00 $12.00

قراءة الجدول:

السعر ليس جودة، وجداول المعايير الخاصة بالبائعين هي جداول معايير خاصة بالبائعين. ولكن على مستوى بطاقة الأسعار البحتة، يعتبر Qwen 3.8-Max أرخص نموذج رائد من الفئة المتقدمة في هذه التشكيلة.

أمثلة عملية: تكلفة المهام الحقيقية

الأسعار المعلنة لا تعني الكثير بدون حسابات موجهة للمهام. ثلاثة سيناريوهات، محسوبة بسعر 2 دولار / 6 دولارات:

المثال 1: جلسة وكيل بـ 50 ألف توكن

تستهلك عملية تشغيل وكيل 38,000 توكن إدخال (تعليمات، مخططات أدوات، نتائج أدوات) وتنتج 12,000 توكن إخراج:

الآن أضف استدلال xhigh الافتراضي. لنفترض أن النموذج يقضي 8,000 توكن تفكير خلال العملية. يصبح الإخراج 20,000 توكن: 20,000 × 6 دولارات / 1,000,000 = 0.12 دولار، ويبلغ إجمالي الجلسة حوالي 0.20 دولار. هذه زيادة بنسبة 33% من الاستدلال وحده، وهذا بالضبط سبب قياسك قبل وضع الميزانية.

المثال 2: تحليل مستند طويل بـ 800 ألف توكن

تقوم بتحميل 800,000 توكن من المستندات في السياق وتطلب ملخصًا منظمًا بـ 5,000 توكن:

الطبقة السعرية الثابتة هي التي تؤدي العمل هنا. كل توكن من تلك الـ 800 ألف توكن يكلف نفس السعر 2 دولار لكل مليون مثل الألف الأولى. في النموذج المتدرج، هذا هو بالضبط شكل الطلب الذي يؤدي إلى الفئة السعرية المكلفة.

المثال 3: موجه نظام مخزن مؤقتًا بـ 100 ألف توكن، 50 استدعاءً يوميًا

يقوم تطبيقك بتحميل 100,000 توكن من موجه النظام ووثائق المنتج وتعريفات الأدوات في كل استدعاء، 50 مرة يوميًا.

بدون تخزين مؤقت: 100,000 × 2 دولار / 1,000,000 = 0.20 دولار لكل استدعاء، أي 10.00 دولارات يوميًا على البادئة وحدها.

مع التخزين المؤقت الصريح: يكلف الإنشاء 100,000 × 2.50 دولار / 1,000,000 = 0.25 دولار لمرة واحدة، ثم 49 إصابة ذاكرة مؤقتة بتكلفة 100,000 × 0.20 دولار / 1,000,000 = 0.02 دولار لكل منها، أو 0.98 دولار. الإجمالي اليومي: حوالي 1.23 دولار، توفير بنسبة 88%. على مدار شهر، هذا يعني حوالي 300 دولار مقابل أقل من 40 دولارًا.

قدّر التكاليف بناءً على الاستخدام المقاس، لا التخمينات

تعتمد جميع الأمثلة الثلاثة على أعداد توكنات مفترضة. ستختلف أرقامك الحقيقية، ومع توكنات الاستدلال في اللعب، ستختلف بطرق لا يمكنك التنبؤ بها من طول الموجه وحده. الحل هو القياس.

سير عمل عملي: احصل على مفتاح API الخاص بك، قم بإعداد نقطة النهاية (يغطي دليل Qwen 3.8 API جميع عناوين URL الأساسية الإقليمية الثلاثة وكلاً من بروتوكولات المتوافقة مع OpenAI والمتوافقة مع Anthropic)، وأرسل طلبات تمثيلية لكل نوع مهمة في تطبيقك. تُرجع كل استجابة كائن usage مع عدد توكنات الإدخال والإخراج والاستدلال الدقيقة.

في Apidog، احفظ عناوين URL الأساسية الإقليمية الثلاثة كبيئات، وأرسل نفس الطلب لكل مستوى من مستويات reasoning_effort، واقرأ استخدام التوكنات مباشرة من مفتش الاستجابة. قم بتشغيل عشرة طلبات تمثيلية لكل نوع مهمة، وخذ متوسط الأعداد، واضربها في 2 دولار / 6 دولارات، وبذلك يكون لديك نموذج تكلفة مبني على بيانات مقاسة. يمكنك أيضًا إجراء اختبار A/B لنفس الموجه مقابل qwen3.7-max أو Kimi K3 في نفس مساحة العمل لمعرفة ما إذا كان النموذج الأرخص يصمد أمام عبء عملك. قم بتنزيل Apidog مجانًا ويمكنك الحصول على أرقام تكلفة حقيقية لكل مهمة في غضون ساعة.

الخلاصة

يُعد Qwen 3.8-Max بسعر 2 دولار / 6 دولارات تسعيرًا قويًا لنموذج رائد من الفئة المتقدمة: أقل من السعر المعلن لسابقه، ونصف سعر إخراج GPT-5.6 Terra، وجزء صغير من Opus 5، وثابت عبر سياق كامل يبلغ مليون توكن حيث تتدرج أسعار الكثير من السوق. أضف 10% من إصابات الذاكرة المؤقتة، وتبدو الجدوى الاقتصادية لأعباء العمل ذات السياق الطويل والتكرار العالي قوية حقًا.

تحذيران: يؤدي الاستدلال الافتراضي xhigh إلى تضخيم فواتير الإخراج فوق التقديرات الساذجة، والخصومات المحيطة به (3.7-Max بخصم 50%، وحصة سنغافورة المجانية) محدودة زمنيًا. قم بقياس استخدامك الحقيقي للتوكنات، واضبط reasoning_effort بعناية، وبذلك لن تحمل بطاقة الأسعار الكثير من المفاجآت.

button

الأسئلة الشائعة

هل يكلف Qwen 3.8 أكثر للموجهات الطويلة؟

لا. الأسعار الرسمية تدرج طبقة واحدة تغطي من 0 إلى مليون توكن، لذا يتم احتساب موجه بـ 900 ألف توكن بنفس سعر الإدخال البالغ 2 دولار لكل مليون مثل الموجه القصير. يختلف هذا عن النماذج المتدرجة، بما في ذلك بعض النماذج في كتالوج علي بابا الخاص ضمن قائمة نماذج Model Studio، حيث تزداد الأسعار مع طول السياق.

هل تكلف توكنات التفكير رسومًا إضافية في Qwen 3.8؟

لا يوجد سعر منفصل للتفكير: تُحسب أوضاع التفكير وعدم التفكير بنفس سعر 2 دولار / 6 دولارات. لكن توكنات التفكير تُحتسب كتوكنات إخراج بسعر 6 دولارات لكل مليون، وreasoning_effort الافتراضي هو xhigh. لذلك، تكلف الطلبات التي تتطلب استدلالًا كبيرًا أكثر مما تشير إليه الإجابة المرئية. اخفض مستوى الجهد للمهام البسيطة، وتحقق من كائن usage في كل استجابة لترى ما تدفع مقابله بالفعل.

هل هناك طريقة مجانية لتجربة Qwen 3.8؟

نعم. يتضمن Model Studio حصة مجانية قدرها مليون توكن، صالحة لمدة 90 يومًا، على نقطة نهاية منطقة سنغافورة فقط. يوفر Qwen Chat أيضًا وصولاً مجانيًا في المتصفح. كلا المسارين، بالإضافة إلى التفاصيل الدقيقة، مشمولان في كيفية استخدام Qwen 3.8 مجانًا.

هل لا يزال "تسعير المعاينة بخصم 10%" القديم متاحًا؟

لا. كان ذلك عرضًا ترويجيًا لفترة المعاينة تم الإبلاغ عنه في التغطية الصحفية لشهر يوليو 2026؛ وقد حل التوفر العام محله ببطاقة الأسعار القياسية البالغة 2 دولار / 6 دولارات. تعامل مع صفحة تسعير Model Studio على أنها مصدر الحقيقة.

ممارسة تصميم API في Apidog

اكتشف طريقة أسهل لبناء واستخدام واجهات برمجة التطبيقات