إليك القرار منذ البداية. اختر Gemini 3.5 Flash-Lite عندما تقوم بتشغيل مهام بسيطة بكميات كبيرة ويهمك التكلفة والسرعة أكثر من أي شيء آخر: التصنيف، الاستخراج، الردود القصيرة في الدردشة، إجابات RAG، الإكمال التلقائي. اختر Gemini 3.6 Flash عندما تكون الجودة أهم من الفاتورة: وكلاء متعدد الخطوات، استخدام الأدوات، البرمجة، استخدام الكمبيوتر، والإجابات التي يكون فيها الخطأ مكلفًا.
تم إطلاق كلا النموذجين ضمن تحديث Google Flash-tier في 21 يوليو 2026. يقبل كلاهما ما يصل إلى مليون رمز إدخال. يقعان في نقاط مختلفة على نفس المنحنى، لذا فإن السؤال ليس حقًا أي نموذج "أفضل". بل يتعلق الأمر بالمقايضة التي تناسب المهمة التي أمامك.
أولًا، توضيح لخصوصية في التسمية: النموذج الأساسي قفز إلى 3.6، لكن فئة Lite بقيت على 3.5. لذا فأنت تقارن نموذج 3.5 بنموذج 3.6، وهذا أمر متوقع، وليس خطأ مطبعيًا. المزيد عن ذلك في الأسئلة الشائعة.
الإجابة المختصرة
استخدم Flash-Lite افتراضيًا لأي شيء بسيط تقوم بتشغيله ملايين المرات، واستعن بـ 3.6 Flash فورما تتطلب المهمة تفكيرًا أو أدوات أو تعليمات برمجية. إذا لم تتمكن من اتخاذ قرار، ابدأ بـ Flash-Lite، راقب أين تكون الإجابات قاصرة، وقم بترقية تلك الاستدعاءات فقط إلى 3.6 Flash. نادرًا ما تحتاج إلى نموذج واحد للتطبيق بأكمله.
السعر والسرعة جنبًا إلى جنب
| السمة | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash |
|---|---|---|
| معرف النموذج | gemini-3.5-flash-lite |
gemini-3.6-flash |
| سعر الإدخال | 0.30 دولار / مليون رمز | 1.50 دولار / مليون رمز |
| سعر الإخراج | 2.50 دولار / مليون رمز | 7.50 دولار / مليون رمز |
| الإنتاجية | ~350 رمز إخراج/ثانية | لم تُنشر بشكل منفصل |
| نافذة السياق | مليون رمز | مليون رمز |
| الطبقة المجانية | نعم (بحدود معدل) | نعم (بحدود معدل) |
Flash-Lite أرخص في كل رمز. تكلفة الإدخال أقل بخمس مرات؛ وتكلفة الإخراج أقل بثلاث مرات. تنشر Google رقم إنتاجية يبلغ حوالي 350 رمز إخراج في الثانية لـ Flash-Lite، وهذا ما يجعله يبدو فوريًا في مربع الدردشة أو حقل الإكمال التلقائي. لم تنشر Google رقمًا منفصلاً للرموز في الثانية لـ 3.6 Flash، لكن 3.6 Flash ينتج حوالي 17% رموز إخراج أقل من 3.5 Flash الذي يحل محله، لذا فإنه ينهي العمل متعدد الخطوات بشكل أسرع مما يوحي به السعر المعلن. يمكنك تأكيد الأسعار الحالية على صفحة تسعير Gemini API وفي تحليل تسعير Gemini 3.6 Flash لدينا.
الجودة والمعايير
فارق السعر يمنحك مجالًا في المهام الصعبة. في Terminal-Bench 2.1، الذي يقيس العمل الوكيل للطرفيات، يسجل Flash-Lite 54 بينما يسجل 3.6 Flash 78.0. هذا الفارق البالغ 24 نقطة هو القصة بأكملها: في المهام متعددة الخطوات التي تعتمد على الأدوات، يعد 3.6 Flash النموذج الأقوى بفارق واضح.

كما يسجل 3.6 Flash 83.0 في OSWorld-Verified، وهو معيار استخدام الكمبيوتر الذي يقيس تشغيل متصفح أو سطح مكتب حقيقي. لا يستهدف Flash-Lite هذه المهارة. إذا كان عبء عملك يتضمن النقر على الشاشة، فهذه مهمة 3.6 Flash. وفيما يتعلق بالترميز على وجه التحديد، يسجل 3.6 Flash 58.7% على SWE-Bench Pro و 49% على DeepSWE v1.1، وهي أنواع من النتائج تضعه في منطقة الترميز الوكيل الحقيقي. لا يستهدف Flash-Lite هذا النوع من العمل.
يجدر بنا أن نكون منصفين لـ Flash-Lite هنا. فقد ارتفعت نتيجته 54 على Terminal-Bench 2.1 من 31 في جيل Lite السابق، لذا أصبحت الفئة الرخيصة أكثر قدرة بكثير في هذه الجولة. إنه ليس نموذجًا ضعيفًا. إنه نموذج مُعد لمهمة مختلفة: تفكير سريع ورخيص وجيد بما فيه الكفاية في المهام التي لا تتفرع. صفحة نموذج Flash الخاصة بجوجل و إعلان الإطلاق يحددان الفئتين بنفس الطريقة: فئة للحجم، وفئة للعمق.
أي نموذج لأي مهمة
استخدم هذا كمصفوفة بداية، ثم عدلها بتقييماتك الخاصة.
| المهمة | الأفضل ملاءمة |
|---|---|
| تصنيف أو استخراج بكميات كبيرة | Flash-Lite |
| مساعدي الدردشة والردود القصيرة | Flash-Lite |
| إجابات RAG على السياق المسترجع | Flash-Lite |
| تجربة المستخدم الحساسة للكمون (مثل الإكمال التلقائي) | Flash-Lite |
| خطوط أنابيب على نطاق البحث، لكل طلب | Flash-Lite |
| الوكلاء متعددي الخطوات | 3.6 Flash |
| استخدام الأدوات وسلاسل استدعاء الوظائف | 3.6 Flash |
| الترميز ومراجعة التعليمات البرمجية | 3.6 Flash |
| استخدام الكمبيوتر (المتصفح أو سطح المكتب) | 3.6 Flash |
| إجابات عالية الأهمية حيث تكلف الأخطاء أموالاً | 3.6 Flash |
النمط بسيط. يفوز Flash-Lite عندما تكون المهمة ضيقة والحجم كبير. ويفوز 3.6 Flash عندما تتفرع المهمة وتكون تكلفة الخطأ عالية. النموذج الذي يصنف تذاكر الدعم حسب الفئة عشرة ملايين مرة في اليوم ينتمي إلى Flash-Lite. والنموذج الذي يقرأ تتبعًا للمكدس، ويعدل ثلاثة ملفات، ويفتح طلب سحب ينتمي إلى 3.6 Flash. إذا كنت تقارن هذا بـ 3.5 Flash الأقدم بدلاً من Flash-Lite، فإن مقارنة 3.6 Flash مقابل 3.5 Flash لدينا تغطي مسار الترقية هذا.
مقارنة التكلفة على نفس عبء العمل
الأرقام تجعل المقايضة ملموسة. لنفترض أن مهمة يومية ترسل 10 ملايين رمز إدخال وتولد 2 مليون رمز إخراج، وهو شكل نموذجي لخط أنابيب تلخيص أو استخراج دفعة.
| النموذج | الإدخال (10M) | الإخراج (2M) | الإجمالي اليومي |
|---|---|---|---|
| Flash-Lite | 3.00 دولار | 5.00 دولارات | 8.00 دولارات |
| 3.6 Flash | 15.00 دولار | 15.00 دولار | 30.00 دولار |
بهذه التركيبة، يكلف 3.6 Flash أكثر بـ 3.75 مرة: 8.00 دولارات مقابل 30.00 دولارًا في اليوم، أو حوالي 240 دولارًا مقابل 900 دولار شهريًا لنفس الحجم.
لكن المضاعف ليس ثابتًا. نظرًا لأن Flash-Lite أرخص بـ 5 مرات في الإدخال و 3 مرات أرخص في الإخراج، فإن مدخراتك الحقيقية تتراوح بين 3 و 5 أضعاف اعتمادًا على شكل حركة المرور الخاصة بك. العمل الثقيل على الإدخال (سياق RAG طويل، مستندات كبيرة، تصنيف مدخلات كبيرة) يميل نحو حد 5 أضعاف، وهذه هي بالضبط أحمال العمل التي تم تصميم Flash-Lite لها. يميل التوليد الثقيل على الإخراج نحو 3 أضعاف.
لذا فإن السؤال الحقيقي ليس فقط "هل يمكن لـ 3.6 Flash فعل هذا؟" بل هو "هل تستحق زيادة الجودة دفع 3 إلى 4 أضعاف أكثر لكل استدعاء، بحجم عملي هذا؟" بالنسبة لخط أنابيب على نطاق البحث، الإجابة عادة ما تكون لا. وبالنسبة لوكيل يقوم بتحرير التعليمات البرمجية أو يقدم تذكرة، الإجابة عادة ما تكون نعم.
كيفية اختبار A/B لكلاهما في Apidog
ليس عليك تخمين أي فئة مناسبة بما فيه الكفاية. Gemini API هي نقطة نهاية REST بسيطة، لذا يمكنك إرسال نفس المطالبة إلى كلا النموذجين ومقارنة الاستجابات مباشرة. Apidog هو عميل API مصمم خصيصًا لهذا النوع من الفحص جنبًا إلى جنب.

إليك سير عمل يستغرق بضع دقائق:
- أنشئ طلب POST إلى نقطة نهاية Gemini API وقم بتخزين مفتاح API الخاص بك في متغير بيئة Apidog، بحيث لا يبقى المفتاح أبدًا في نص الطلب أو في نظام التحكم في الإصدار.
- أرسله مرة واحدة مع تعيين النموذج على
gemini-3.5-flash-lite. لاحظ الاستجابة وزمن الاستجابة الذي يبلغه Apidog. - كرر الطلب وقم بتغيير شيء واحد: معرف النموذج إلى
gemini-3.6-flash. نفس المطالبة، نفس المعلمات، لذلك المتغير الوحيد هو النموذج. - قارن الاستجابتين من حيث الجودة، وقارن الأوقات التي يسجلها Apidog لكل استدعاء.
- أضف تأكيدات على الاستجابة (رمز الحالة، حقول JSON المتوقعة، المحتوى المطلوب) بحيث يتم تعريف "جيد بما فيه الكفاية" من خلال فحص، وليس بالنظر فقط.
بمجرد وجود الطلبات، احفظها وحولها إلى اختبار قابل للتكرار. يمكنك جدولة اختبارات API في Apidog لإعادة تشغيل نفس المطالبات بوتيرة منتظمة، مما يكتشف أي انحراف في الجودة أو الكمون عندما تحدث Google أيًا من النموذجين. كن واضحًا بشأن الحدود: يرسل Apidog الطلبات ويتحقق من تأكيداتك، ولكنه لا يقوم بتشغيل النموذج، ولن يخبرك أي إجابة أذكى. هذا الحكم يبقى لك. للمتابعة، قم بتنزيل Apidog ووجه طلبًا إلى نقطة نهاية Gemini.
الأسئلة الشائعة
هل Flash-Lite مجرد نسخة أسوأ من 3.6 Flash؟ لا. إنها نقطة مختلفة على منحنى التكلفة والجودة والسرعة. Flash-Lite أرخص وأسرع بحد أدنى في التفكير الصعب؛ 3.6 Flash يكلف أكثر ويفكر بشكل أفضل. في المهام البسيطة ذات الحجم الكبير، غالبًا ما يكون Flash-Lite هو الإجابة الصحيحة بالضبط لأنه أرخص وأسرع، وليس بالرغم من ذلك.
لماذا يُسمى أحدهما 3.5 والآخر 3.6؟ إصدارات مختلطة. في هذا التحديث، نقلت Google نموذج Flash الأساسي إلى 3.6 ولكنها أبقت فئة Lite عند 3.5 (تضمن نفس الإصدار أيضًا نموذج Flash Cyber الأمني 3.5). نفس العائلة، أرقام إصدارات مختلفة. لا تقرأ 3.5 على Flash-Lite على أنه "قديم ومهجور".
هل يتقاسمان نفس نافذة السياق؟ نعم. كلاهما يقبل ما يصل إلى مليون رمز إدخال، لذا فإن المطالبات ذات السياق الطويل ليست سببًا لاختيار أحدهما على الآخر. اختر بناءً على جودة التفكير والسعر والسرعة بدلاً من ذلك.
هل يمكنني استخدام كلاهما في تطبيق واحد؟ هذا هو النمط الموصى به. وجه الاستدعاءات الرخيصة والبسيطة وذات الحجم الكبير إلى Flash-Lite وقم بتصعيد الاستدعاءات الصعبة إلى 3.6 Flash. نظرًا لأن شكل API متطابق، فإن التبديل هو تغيير حقل واحد، وهذا ما يجعل اختبار A/B في Apidog سريع التشغيل.
هل هما مجانيان للتجربة؟ كلاهما يحتوي على طبقة مجانية في Google AI Studio، بحدود معدل، وقد تستخدم Google بيانات الطبقة المجانية لتحسين منتجاتها. هذا جيد للاختبار؛ اقرأ الشروط قبل إرسال أي شيء حساس.
الخلاصة
استعن بـ Flash-Lite كخيار افتراضي لعملك الرخيص والسريع والبسيط على نطاق واسع، وقم بترقية الاستدعاءات الصعبة والمتفرعة أو التي تتضمن الكثير من التعليمات البرمجية إلى 3.6 Flash حيث يستحق الفارق البالغ 24 نقطة في Terminal-Bench سعره البالغ 3 إلى 4 أضعاف. لا تختر بشكل مجرد: أرسل مطالباتك الحقيقية إلى كليهما، وقم بقياس الجودة وزمن الاستجابة، ودع الأرقام تقرر. Apidog يجعل هذه المقارنة مهمة من طلبين.
