تقدم Alibaba الآن خطين لصور Qwen لا يتشاركان تسلسل إصدار. Qwen-Image-2.1، الذي صدر في 20 سبتمبر 2026، هو نموذج الأوزان المفتوحة: 7 مليار معلمة في المولد، إخراج شفاف أصلي، تحرير بما يصل إلى 10 مراجع، قابل للتنزيل من Hugging Face. Qwen Image 3.0 و 3.0 Pro، أُعلن عنهما في 22 يوليو ومتوفران على واجهة برمجة التطبيقات (API) منذ 4 أغسطس 2026، هما نماذج مستضافة بأسعار لكل صورة وبدون أوزان منشورة. يشير الرقم إلى أن "3.0 أحدث"، لكن التوصيف الصادق هو أنهما يجيبان على أسئلة مختلفة: هل تريد تشغيل النموذج أم استئجاره؟
تضع هذه الصفحة النموذجين جنبًا إلى جنب فيما يتعلق بالترخيص والتكلفة والإمكانيات والعمليات، وتنتهي بجدول اتخاذ القرار. للاطلاع على ميزات 2.1، انظر ما هو Qwen-Image-2.1؛ وللكود، انظر دليل كيفية الاستخدام. أيًا كان اختيارك، ينتهي الأمر بالنموذجين كنقطة نهاية HTTP يستدعيها تطبيقك، ويمكن لـ Apidog الاحتفاظ بهما معًا خلف مجموعة واحدة، بحيث يكون التبديل مجرد تغيير في التكوين.
مقارنة
| Qwen-Image-2.1 | Qwen Image 3.0 / 3.0 Pro | |
|---|---|---|
| تاريخ الإصدار | 20 سبتمبر 2026 | أُعلن عنه في 22 يوليو 2026؛ واجهة برمجة التطبيقات (API) في 4 أغسطس 2026 |
| التوزيع | أوزان مفتوحة (Hugging Face, ModelScope) | واجهة برمجة تطبيقات مستضافة فقط؛ لا توجد أوزان منشورة [تحقق] |
| الترخيص / الشروط | ترخيص Qwen للأبحاث؛ الاستخدام التجاري يتطلب ترخيصًا منفصلاً | شروط خدمة واجهة برمجة التطبيقات القياسية |
| السعر | وقت وحدة معالجة الرسوميات الخاصة بك | qwen-image-3.0: 0.03 دولار لكل صورة (1K أو 2K). qwen-image-3.0-pro: 0.04 دولار عند 1K، 0.075 دولار عند 2K. صور الإدخال 0.003 دولار لكل منها [تحقق] |
| حجم المولد | 7B (32 طبقة DiT أحادية التدفق) + مُشفر Qwen3-VL 8B | غير معلن |
| أقصى دقة | 2048 × 2048 افتراضيًا؛ حتى 2752 × 1536 | 2048 × 2048 |
| إخراج شفاف | توليد وتحرير RGBA أصلي | لم يتم الإعلان عنه |
| الصور المرجعية | حتى 10 | صور الإدخال مدعومة (بسعر لكل صورة)؛ لم يتم نشر الحد الأقصى [تحقق] |
| التحرير المحلي | دوائر، تعليقات مرسومة، قناع منفصل | لم يتم الإعلان عنه في مواد الإطلاق |
| عرض النص | تحسين الطباعة والنمط والتخطيط | الميزة الرئيسية: نص دقيق بحجم حوالي 10 بكسل، 12 لغة (وفقًا للتقرير الذاتي) |
| المخرجات لكل استدعاء | واحدة (تقوم أنت بالتكرار) | حتى 6 |
| طول المطالبة | غير مذكور | حوالي 4.5 ألف توكن في Pro (ادعاء رسمي) |
| إعادة كتابة المطالبة | نماذج PE-T2I / PE-I2I منفصلة تقوم بتشغيلها بنفسك | تُعالج من جانب الخادم |
| أين يمكنك التجربة | HF Space, Qwen Chat, ComfyUI | وحدة تحكم Model Studio, Qwen Chat |
مصادر عمود 3.0 هي إعلان Alibaba لشهر يوليو ووثائق QwenCloud كما لخصتها LLM Stats؛ أعد التحقق من جدول الأسعار في Model Studio قبل وضع الميزانية، لأن تسعير الصور يعتمد على المنطقة.
الترخيص هو الفلتر الأول
بالنسبة لمعظم الفرق، ينهي هذا الصف المقارنة. ينص ترخيص 2.1 على أنه "لا يجوز لك استخدام المواد لأي غرض تجاري دون الحصول على ترخيص تجاري منفصل". هذا يختلف عن شروط Apache 2.0 التي تم شحن Qwen-Image الأصلي بموجبها، ويعني أن الميزة الموجهة للعملاء والمبنية على 2.1 تتطلب رسالة بريد إلكتروني إلى فريق أعمال Qwen واتفاقية موقعة قبل الإطلاق.
Qwen Image 3.0 هو واجهة برمجة تطبيقات مدفوعة بشروط تجارية قياسية. تدفع لكل صورة ويمكنك الشحن.
إذن: للبحث والتقييم والأدوات الداخلية، أو مشروع تكون فيه مستعدًا للتفاوض على ترخيص، فإن 2.1 مطروح على الطاولة. لميزة منتج يتم شحنها هذا الربع بدون ميزانية قانونية، 3.0 هو الخيار الافتراضي.
التكلفة: فاتورة وحدة معالجة الرسوميات مقابل ثلاثة سنتات للصورة
الطبقة القياسية 3.0 هي 0.03 دولار لكل صورة بأي دقة، لذا 10,000 صورة شهريًا تكلف 300 دولار، بالإضافة إلى 0.003 دولار لكل صورة إدخال عند التعديلات. Pro يضاعف التكلفة عند 2K.
الاستضافة الذاتية لـ 2.1 لا تتضمن سعرًا لكل صورة، لكن الحسابات تكون مواتية فقط عند الأحجام الكبيرة ومع وحدة معالجة رسوميات قد تتركها خاملة بخلاف ذلك. لا تنشر Qwen أرقام الإنتاجية، لذا قم بقياسها بنفسك: عند 40 خطوة و 2048 × 2048 على وحدة معالجة رسوميات واحدة لمركز البيانات، احسب الصور في الساعة، اقسم السعر بالساعة، وقارن ذلك بـ 0.03 دولار. يُعد التحرير بالعديد من المراجع هو المكان الذي يساعد فيه إعادة استخدام ذاكرة التخزين المؤقت KV الخاصة بـ 2.1، حيث يتم ترميز الصور المرجعية مرة واحدة لكل طلب بدلاً من كل خطوة. إذا كانت وحدة معالجة الرسوميات الخاصة بك مشتركة مع أعباء عمل أخرى، فتذكر أن توليد الصور سيستهلكها بالكامل خلال فترات الذروة.
قاعدة تقريبية: لأقل من بضعة آلاف من الصور شهريًا، تكون واجهة برمجة التطبيقات أرخص بمجرد حساب وقت الهندسة. فوق عشرات الآلاف شهريًا مع حمل ثابت واتفاقية ترخيص سارية، تفوز الاستضافة الذاتية. بين هذين الخيارين، يعتمد الأمر على ما إذا كنت تشغل وحدات معالجة رسوميات بالفعل.
الإمكانيات: الشفافية مقابل النص الكثيف
بُني النموذجان لمهام مختلفة.
اختر 2.1 عندما يحتاج الإخراج إلى قناة ألفا. الملصقات، قص المنتجات، أصول واجهة المستخدم، التركيبات الطبقية، استخراج موضوع من صورة كـ RGBA: يقوم 2.1 بذلك أصلاً في نفس النموذج، بما في ذلك تحرير طبقة شفافة دون فقدان شفافيتها. لا تذكر مواد إطلاق 3.0 إخراج ألفا. القيام بذلك على 3.0 يعني خطوة منفصلة لإزالة الخلفية مع العيوب الهالية التي تأتي معها.
اختر 2.1 عندما يكون التحرير هو عبء العمل. عشر صور مرجعية، تحديد المنطقة بالدائرة أو الطلاء أو القناع، وعمل دقيق على الوجوه والمنتجات هي جوهر إصدار 2.1. يعرض منشور الإطلاق صورًا جماعية من ست صور شخصية، وأزياء من خمس لقطات منتجات، وغرفة مفروشة من عشر صور أثاث.
اختر 3.0 عندما تكون الصورة نصية بمعظمها. لوحات المعلومات، الهياكل الشبكية، الملصقات، وتصاميم شبيهة بالشرائح بنصوص دقيقة بعدة لغات هي ما تم ضبط 3.0 لأجله. قام 2.1 بتحسين الطباعة أيضًا، لكن ادعاء 3.0 بـ "نص بحجم 10 بكسل بـ 12 لغة" هو الادعاء الأقوى المنشور، وميزانية المطالبة التي تبلغ 4.5 ألف توكن على Pro تناسب مواصفات التخطيط الطويلة.
اختر 3.0 عندما تحتاج إلى عدة مرشحات لكل استدعاء. ما يصل إلى ستة مخرجات لكل طلب هي ميزة سير عمل لا يمتلكها 2.1؛ مع 2.1، تقوم بالتكرار على البذور.
لا تعرض أي صفحة بائع جدول مقارنات مع أرقام. يعرض منشور 2.1 مخطط Qwen-Image-Bench؛ ادعاءات 3.0 هي تقارير ذاتية. تعامل مع كليهما كمحفزات لتقييمك الخاص، والذي يجعله قسم Apidog قابلاً للتكرار.
العمليات: ما تملكه
الاستضافة الذاتية لـ 2.1 تعني امتلاك: تنزيلات وتحديثات النموذج، وحدة معالجة رسوميات بذاكرة كافية (لا تنشر Qwen جدول VRAM؛ يقدم ملف README تفريغًا لوحدة المعالجة المركزية ويشير إلى vLLM-Omni مع FP8 و SGLang و LightX2V)، غلاف تقديم، وضع قائمة انتظار تحت حمل الذروة، ونموذجي إعادة كتابة المطالبة الاختياريين إذا كنت تريد أن تعمل المطالبات ذات السطر الواحد. في المقابل، تحصل على محلية البيانات، لا توجد قيود على المعدل سوى قيودك الخاصة، وإصدار نموذج ثابت لا يغيره أحد دون علمك.
استخدام 3.0 يعني امتلاك: حساب Alibaba Cloud واختيار المنطقة، مفاتيح API، معالجة قيود المعدل، وخطر تغيير النموذج المستضاف لسلوكه بين تشغيلك التجريبي والإنتاج. في المقابل، تحصل على بنية تحتية صفرية وفاتورة لكل صورة.
توضح أدلة Nano Banana 2 API و gpt-image-2.5 API نفس المفاضلات المستضافة لـ Google و OpenAI، إذا كنت تقارن بين البائعين بدلاً من داخل Qwen.
جدول القرار
| حالتك | اختر |
|---|---|
| شحن ميزة تجارية هذا الربع، لا توجد ميزانية قانونية | 3.0 |
| تحتاج إلى صور PNG شفافة أو تحرير RGBA | 2.1 (مع ترخيص إذا كان تجاريًا) |
| التحرير بالعديد من الصور المرجعية | 2.1 |
| تخطيطات كثيفة النصوص بعدة لغات | 3.0 |
| البحث والتقييم والأدوات الداخلية | 2.1 |
| أقل من بضعة آلاف صورة شهريًا | 3.0 |
| عشرات الآلاف شهريًا، وحدات معالجة الرسوميات تعمل بالفعل، ترخيص موقع | 2.1 |
| لا يمكن للبيانات مغادرة شبكتك | 2.1 |
| تريد ستة مرشحين لكل طلب | 3.0 |
تشغيل كليهما خلف مجموعة واحدة
الإجابة العملية للعديد من الفرق هي كلاهما: 2.1 لخط أنابيب الأصول الشفافة والأدوات الداخلية، و 3.0 لتخطيطات النصوص المواجهة للعملاء. يعمل ذلك بسلاسة إذا كان الاثنان موجودين خلف عقد واحد.
في Apidog، حدد نقطة نهاية POST /v1/images مرة واحدة، مع prompt و aspect و transparent و seed وحقل ملف references، وقم بإعداد بيئتين: base_url يشير إلى غلاف 2.1 الخاص بك (يحتوي دليل كيفية الاستخدام على إصدار FastAPI من 40 سطرًا) والآخر يشير إلى محول لنقطة نهاية 3.0 الخاصة بـ Model Studio. ثم:
- أرسل نفس مجموعة المطالبات إلى كليهما ببذور ثابتة واحفظ الاستجابات كحالات اختبار.
- تحقق مما يختلف:
Content-Type، حدود حجم الاستجابة، وبالنسبة لـ 2.1، رأسX-Image-Mode: RGBAعند طلب الشفافية. - سجل وقت الاستجابة لكل طلب؛ يعرض Apidog ذلك في كل تشغيل، وهو رقم الإنتاجية الذي لا تنشره Qwen.
- شغل السيناريو أسبوعيًا. عندما يتغير سلوك 3.0 المستضاف أو تستبدل 2.1 ببنية مكممة، يظهر الفرق في التقرير، وليس في تذاكر الدعم.
- احاكي نقطة النهاية بحيث يتم بناء الواجهة الأمامية وفقًا للعقد بينما لا يزال اختيار النموذج مفتوحًا.
قم بتنزيل Apidog واستورد نقطة النهاية لبدء المقارنة.
الأسئلة الشائعة
هل Qwen Image 3.0 مفتوح المصدر؟ لم يتم إصدار أوزان عامة لـ 3.0 أو 3.0 Pro؛ فهي نماذج API مستضافة [تحقق]. Qwen-Image-2.1 هو الإصدار ذو الأوزان المفتوحة.
هل يمكنني استخدام Qwen-Image-2.1 تجاريًا؟ فقط بترخيص تجاري منفصل من Qwen. يرخيص Qwen للأبحاث الافتراضي يستبعد الاستخدام التجاري.
أيهما أرخص؟ في الأحجام المنخفضة، 3.0 بسعر 0.03 دولار لكل صورة. في الأحجام العالية والثابتة على الأجهزة التي تشغلها بالفعل، 2.1، بعد الحصول على ترخيص وقياس إنتاجيتك الخاصة.
هل يقوم 3.0 بتوليد صور شفافة؟ لم يتم الإعلان عن ذلك. إخراج RGBA الأصلي هو ميزة 2.1؛ انظر ما هو Qwen-Image-2.1.
هل يمكنني تجربة أي منهما مجانًا؟ يمتلك 2.1 مساحة Hugging Face وإمكانية الوصول إلى Qwen Chat؛ يسرد دليل الطبقة المجانية الخيارات. يتوفر 3.0 في Qwen Chat وعبر حصة Model Studio التجريبية، والتي تختلف حسب المنطقة.
إلى أين نذهب بعد ذلك
2.1 و 3.0 هما فرعان، وليسا مسار ترقية. الترخيص يقرر السؤال الأول، وعبء العمل يقرر الثاني، والحجم يقرر الثالث. أيًا كان ما تختاره، ضعه خلف عقد تختبره: دليل كيفية الاستخدام يبني جانب 2.1، ويمكن لنفس مجموعة Apidog أن تدعم جانب 3.0 في اليوم الذي تحتاجه.
