جوجل قامت بتحديث طبقة Flash الخاصة بها في 21 يوليو 2026، ويُعد Gemini 3.5 Flash-Lite هو الخيار الاقتصادي منها. إنه أرخص وأسرع نموذج Gemini يمكنك استدعاؤه اليوم، وهو مصمم للأعمال ذات الحجم الكبير والحساسة للكمون: التصنيف، الاستخراج، الردود القصيرة في الدردشة، وإجابات الاسترجاع البسيطة حيث تكون الإنتاجية والتكلفة أهم من التفكير العميق. إذا كنت ترسل ملايين الطلبات الصغيرة يوميًا، فهذه هي الطبقة التي تريدها Google في مسارك الساخن.
أطلق التحديث ثلاثة نماذج في وقت واحد، وقد يربك التسمية البعض، لذا دعنا نوضح ذلك بسرعة ثم ننتقل إلى المواصفات والتسعير والمعايير وكيفية اختبار نقطة النهاية بنفسك.
ما هو Gemini 3.5 Flash-Lite؟
Gemini 3.5 Flash-Lite هو أصغر وأرخص نموذج في عائلة Gemini من Google. تم ضبطه للسرعة والحجم، وليس للتفكير الأعمق. تقدر Google سرعته بحوالي 350 رمزًا إخراجيًا في الثانية، لذا تبدو الاستجابات فورية تقريبًا حتى تحت الضغط. يمكنك استدعاؤه عبر واجهة برمجة تطبيقات Gemini (Gemini API) باستخدام معرف النموذج gemini-3.5-flash-lite.

فكر فيه كطبقة تستهدف المهام المملة والمتكررة وذات التردد العالي. وضع علامات على تذاكر الدعم. استخراج الحقول من مستند. الإجابة على سؤال قصير من جزء من نص مسترجع. تشغيل أداة دردشة تحتاج إلى الرد قبل أن يلاحظ المستخدم أي تأخير. في كل من هذه الحالات، أنت ترسل الكثير من الطلبات وتريد أن يكون كل طلب رخيصًا وسريعًا. Flash-Lite هو إجابة Google لهذا النوع من أعباء العمل.

تم إطلاقه كجزء من تحديث Flash المكون من ثلاثة نماذج: Gemini 3.6 Flash الجديد كنموذج عمل رئيسي، و Gemini 3.5 Flash-Lite هذا، ونموذج أمان محمي يسمى Gemini 3.5 Flash Cyber. يمكنك قراءة ملخص Google الخاص على مدونة Google وتفاصيل النموذج على صفحة DeepMind Flash. يقع Flash-Lite في أسفل هذه القائمة من حيث السعر وفي القمة من حيث السرعة الخام.
انتظر، لماذا هو 3.5 وليس 3.6؟
هذا هو الجزء المربك. النموذج الرئيسي الجديد هو Gemini 3.6 Flash. لكن Flash-Lite بقي على الإصدار 3.5، وكذلك نموذج أمان Cyber المحمي. لذا إطلاق واحد، في يوم واحد، ثلاثة نماذج، رقمان للإصدار. هذا ليس خطأ مطبعيًا من جانب Google ولا خطأ في هذه المقالة. قامت Google بشحن إصدارات مختلطة: قفز Flash الرائد إلى 3.6، بينما احتفظت إصدارات Lite و Cyber بتسمية 3.5.
لماذا تفعل Google ذلك؟ رقم الإصدار يتتبع النموذج، وليس حدث الإطلاق. حصل النموذج الرئيسي على ترقية جيلية أكبر، لذلك استحق علامة 3.6. Flash-Lite هو نموذج جديد أيضًا، لكن Google اختارت أن تبقيه متوافقًا مع خط 3.5. مزعج للتتبع، ولكن هكذا استقرت التسميات.
مصدر آخر للالتباس يستحق التخلص منه الآن. Gemini 3.5 Flash-Lite ليس هو Gemini 3.1 Flash-Lite الأقدم من الجيل السابق. نفس اسم "Flash-Lite"، نموذج مختلف، أرقام مختلفة. إذا كنت قد بنيت على 3.1 Flash-Lite سابقًا، فهذا هو البديل الأحدث والأسرع، وليس إعادة تسمية لما كان لديك بالفعل. تحقق من معرف النموذج قبل الافتراض: gemini-3.5-flash-lite هو الجديد.
المواصفات والتسعير
إليك تكلفة Flash-Lite وكيف يتصرف. جميع الأسعار هي لكل مليون رمز عبر واجهة برمجة تطبيقات Gemini (Gemini API).
| السمة | القيمة |
|---|---|
| معرف النموذج | gemini-3.5-flash-lite |
| سعر الإدخال | $0.30 / مليون رمز |
| سعر الإخراج | $2.50 / مليون رمز |
| السرعة | ~350 رمز إخراج/ثانية |
| الطبقة المجانية | نعم (Google AI Studio، مقيدة بمعدل) |
| تخزين السياق المؤقت | $0.03 / مليون رمز + $1.00 / مليون/ساعة تخزين |
هذا السعر الذي يبلغ 0.30 دولار للإدخال و 2.50 دولار للإخراج هو أرخص سعر منشور في تشكيلة Gemini الحالية. للمقارنة، يبلغ سعر النموذج الرئيسي 3.6 Flash 1.50 دولار للإدخال و 7.50 دولار للإخراج، لذا فإن Flash-Lite يمثل حوالي خُمس تكلفة الإدخال وثلث تكلفة الإخراج. عندما تعالج ملايين المكالمات القصيرة، فإن هذا الفارق هو بيت القصيد. يمكنك تأكيد الأرقام الحالية على وثائق تسعير Gemini API، حيث تحدث Google هذه الصفحة مباشرةً.
يقلل التخزين المؤقت للسياق التكلفة بشكل أكبر للمطالبات التي ترسلها بشكل متكرر، مثل مطالبة نظام ثابتة أو مستند مرجعي طويل. تدفع معدلاً صغيرًا لتخزين الرموز مؤقتًا بالإضافة إلى رسوم تخزين بالساعة، ويكون الإدخال المخزن مؤقتًا أرخص بكثير عند كل إعادة استخدام.
ما مدى جودة أدائه؟
الرقم الرئيسي: يحقق Gemini 3.5 Flash-Lite 54% في اختبار Terminal-Bench 2.1، ارتفاعًا من 31% لسابقه. هذه قفزة حقيقية لنموذج من فئة Lite، ويعني ذلك أن هذه الطبقة الصغيرة أصبحت الآن مفيدة حقًا للمهام التي كانت تفلت منها سابقًا.
المجالات التي يتفوق فيها: التصنيف، الاستخراج، ردود الدردشة، وإجابات الاسترجاع البسيطة المدعومة. هذه هي المهام التي يكسب فيها النموذج السريع والرخيص قيمته. فرز المدخلات في مجموعات، استخراج البيانات المنظمة من النص الفوضوي، الإجابة على سؤال قصير مستند إلى مقطع مسترجع، الحفاظ على استجابة مساعد خفيف الوزن. يتعامل Flash-Lite مع كل ذلك بكفاءة وسرعة.
والآن، الحدود الصريحة. Flash-Lite يقايض الجودة بالتكلفة والسرعة. إنه ليس النموذج المناسب لأصعب مهام البرمجة الذكية، أو سلاسل الأدوات الطويلة متعددة الخطوات، أو مشكلات التفكير العميق. عندما تتطلب مهمة التخطيط عبر عدة خطوات، أو استدعاء الأدوات بشكل موثوق بالتسلسل، أو التفكير في قاعدة بيانات معقدة، فستحتاج إلى Gemini 3.6 Flash أو نموذج أكبر بدلاً من ذلك. اختيار Flash-Lite لهذا العمل يوفر المال إلى أن تكلفك الإجابات الخاطئة أكثر مما وفرته. طابق الطبقة مع المهمة.
أين تستخدم Google نموذج Flash-Lite؟
لا تبيع Google Flash-Lite للمطورين فحسب، بل تقوم بدمج النموذج في بحث Google. هذه إشارة مفيدة: عندما تضع Google نموذجًا أمام حركة مرور بحجم بحثها، فإنها تراهن على أن النموذج سريع ورخيص بما يكفي للعمل على عدد هائل من الاستعلامات دون التأثر بالكمون أو الميزانية.
بالنسبة لك، هذه نقطة إثبات. الخصائص نفسها التي تجعل Flash-Lite مناسبًا للبحث، مثل الإنتاجية العالية والتكلفة المنخفضة لكل مكالمة، هي بالضبط ما يجعله مناسبًا لنقطة نهاية إنتاجية مزدحمة. إذا كان بإمكانه خدمة حركة مرور البحث، فيمكنه خدمة خط أنابيب التصنيف الخاص بك.
Flash-Lite مقابل Gemini 3.6 Flash: أيهما تختار؟
ملخص قصير: اختر Flash-Lite عندما تكون المهمة بسيطة، ذات حجم كبير، وحساسة للسرعة. اختر 3.6 Flash عندما تتطلب المهمة تفكيرًا أقوى، برمجة، أو عمل وكيل متعدد الخطوات.
يتفوق Flash-Lite في السعر والكمون. إنه أرخص نموذج Gemini ويعمل بحوالي 350 رمزًا في الثانية، لذا فهو الخيار الافتراضي الصحيح للتصنيف، والاستخراج، والدردشة القصيرة، و RAG البسيط على نطاق واسع. يكلف Gemini 3.6 Flash أكثر لكل رمز ولكنه يفكر بشكل أعمق، ويبرمج بشكل أفضل، ويصمد في سير العمليات الذكية حيث قد يتعثر Flash-Lite. تسعير 3.6 Flash يعكس ذلك: أنت تدفع مقابل القدرة الإضافية.
نمط عملي هو التوجيه حسب الصعوبة. أرسل المكالمات السهلة والمتكررة إلى Flash-Lite وقم بتصعيد الصعبة إلى 3.6 Flash. تحصل على إنتاجية رخيصة لمعظم حركة المرور وتفكير أقوى فقط حيث يستحق التكلفة. لمقارنة شاملة للسرعة والسعر والجودة، راجع Gemini 3.5 Flash-Lite مقابل 3.6 Flash.
كيفية الوصول إليه واختباره
يعمل Flash-Lite على واجهة برمجة تطبيقات Gemini (Gemini API). أسرع طريقة للبدء هي Google AI Studio: احصل على مفتاح API، وتتيح لك الطبقة المجانية تجربة النموذج قبل إعداد الفواتير. لاحظ أن الطبقة المجانية مقيدة بمعدل، وقد تستخدم Google بيانات الطبقة المجانية لتحسين منتجاتها، لذا احتفظ بالمدخلات الحساسة على مفتاح مدفوع. المرجع الكامل موجود في وثائق Gemini API. اضبط النموذج على gemini-3.5-flash-lite وستقوم باستدعاء الطبقة الأرخص.
بمجرد أن تعمل طلباتك، سترغب في الحفاظ عليها عاملة. تتغير الأسعار وحدود المعدل وأشكال الاستجابة مع تحديث Google لواجهة برمجة التطبيقات، ويحتاج نموذج Lite السريع ولكنه قد يخطئ أحيانًا إلى تأكيدات لاكتشاف أي انحراف. هذا هو المكان الذي يساعد فيه عميل API. باستخدام Apidog، يمكنك بناء طلب POST إلى نقطة نهاية Gemini، وتخزين مفتاح API الخاص بك كمتغير بيئة بحيث لا يظهر أبدًا في نص الطلب، وإضافة تأكيدات على رمز الحالة وحقول JSON التي تعتمد عليها.
من هناك، يمكنك تحويل هذا الطلب إلى اختبار تراجع محفوظ وجدولته للتشغيل حتى تتمكن من اكتشاف استجابة معطلة أو تغيير في الأسعار قبل أن يلاحظها المستخدمون. لا يقوم Apidog بتشغيل النموذج أو استبدال Gemini API؛ إنه العميل الذي تستخدمه لاستدعاء نقطة النهاية والتحقق منها ومراقبتها. قم بتنزيل Apidog إذا كنت ترغب في اختبار نقطة النهاية gemini-3.5-flash-lite جنبًا إلى جنب مع بقية مكدس API الخاص بك.
الأسئلة الشائعة
هل Gemini 3.5 Flash-Lite هو نفسه Gemini 3.6 Flash؟ لا. هما نموذجان مختلفان من نفس التحديث الصادر في 21 يوليو 2026. Flash-Lite هو الطبقة الأرخص والأسرع للعمل البسيط عالي الحجم. أما 3.6 Flash فهو النموذج الرئيسي الأكثر تكلفة مع قدرات تفكير وبرمجة أقوى.
لماذا هو 3.5 وليس 3.6؟ بسبب الإصدارات المختلطة. قامت Google بترقية النموذج الرئيسي Flash إلى 3.6، لكنها أبقت Flash-Lite ونموذج Cyber المحمي على تسمية 3.5 في نفس الإطلاق. الرقم يتتبع خط النموذج، وليس تاريخ الإطلاق.
هل هذا هو Gemini 3.1 Flash-Lite القديم؟ لا. Gemini 3.5 Flash-Lite هو نموذج أحدث. أما 3.1 Flash-Lite الأقدم فهو الجيل السابق. نفس اسم العائلة، لكن نموذج وإصدار مختلفان، لذا تحقق من معرف النموذج gemini-3.5-flash-lite للتأكد من أنك تستخدم الجديد.
هل Gemini 3.5 Flash-Lite مجاني؟ توجد طبقة مجانية عبر Google AI Studio، وهي مقيدة بمعدل. إنها مناسبة للاختبار والاستخدام الخفيف. لأحجام الإنتاج، تنتقل إلى مفتاح API مدفوع، وقد تستخدم Google بيانات الطبقة المجانية لتحسين منتجاتها.
فيما يتفوق Flash-Lite؟ التصنيف، الاستخراج، الردود القصيرة في الدردشة، وإجابات الاسترجاع البسيطة المدعومة بكميات كبيرة. إنه ليس الخيار الأفضل للبرمجة الذكية الصعبة أو التفكير متعدد الخطوات الطويل، حيث يكون 3.6 Flash أكثر ملاءمة.
