أطلقت جوجل نموذج Gemini 3.8 Flash في 2 سبتمبر 2026، بعد ثلاثة أسابيع من Gemini 3.7 Flash وستة أسابيع من 3.6 Flash. بنفس السعر الافتتاحي (0.75 دولار للإدخال، 3.75 دولار للإخراج لكل مليون رمز حتى 31 ديسمبر)، ونفس سياق الرموز البالغ مليون رمز، ووفقًا لتأطير جوجل الخاص، بنفس السرعة تقريبًا. ما تغير هو كيفية عمل النموذج: فهو يتخذ خطوات استدلال أصغر، ويتحقق من مخرجاته الخاصة، ويستدعي الأدوات في حلقات متكررة. وهذا يمنحه درجة أعلى في كل مقياس معياري منشور. كما أنه يجعل كل مهمة تكلف المزيد من الرموز.
لذا، فإن سؤال الترقية ليس "هل 3.8 Flash أفضل؟" نظريًا هو كذلك. السؤال هو ما إذا كانت الجودة الإضافية تستحق الرموز الإضافية لعبء عملك، وما إذا كان التغييران الجذريان يؤثران على شيفرتك البرمجية. تقارن هذه المقارنة بين ما بقي كما هو، وما تحسن، وما يكلفك، ومصفوفة قرار حسب عبء العمل. المصادر هي منشور إطلاق جوجل، وصفحة ما الجديد في Gemini 3.8 Flash، والاختبار المستقل من Artificial Analysis. للحصول على ورقة المواصفات الكاملة، ابدأ من ما هو Gemini 3.8 Flash.
شيء آخر مقدمًا: تقول جوجل إن "Gemini 3.7 Flash لا يزال مدعومًا بالكامل" ولم تنشر أي تاريخ لإيقافه. لا أحد يجبرك على الترقية.
مقارنة جنبًا إلى جنب
| Gemini 3.8 Flash | Gemini 3.7 Flash | |
|---|---|---|
| معرّف النموذج | gemini-3.8-flash |
gemini-3.7-flash |
| تاريخ الإصدار | 2 سبتمبر 2026 | 13 أغسطس 2026 |
| الأساس | "مبني على Gemini 3.7 Flash" (بطاقة النموذج) | غير متوفر |
| السياق / الحد الأقصى للإخراج | 1,048,576 / 65,536 رمزًا | نفسه |
| سعر الإدخال (افتتاحي، حتى 31 ديسمبر) | 0.75 دولار لكل مليون | 0.75 دولار لكل مليون |
| سعر الإخراج (افتتاحي، حتى 31 ديسمبر) | 3.75 دولار لكل مليون، شامل التفكير | 3.75 دولار لكل مليون، شامل التفكير |
| السعر القياسي (اعتبارًا من 1 يناير 2027) | 1.50 دولار / 7.50 دولار | 1.50 دولار / 7.50 دولار |
| قراءة ذاكرة التخزين المؤقت للسياق | 0.075 دولار لكل مليون (افتتاحي) | نفسه |
| الدفعة | خصم 50%، نفس مستويات الرموز في قائمة الانتظار | نفسه |
| مستويات التفكير | low, medium (افتراضي), high |
low, medium, high |
مستوى التفكير minimal |
خطأ في التحقق | مقبول (ملاحظة جوجل للترحيل: ربطه بـ low) |
| تاريخ قطع المعرفة | مارس 2026 | لم يُذكر مجددًا في وثائق 3.8 |
| سرعة الإخراج (Artificial Analysis) | ~300 رمز/ثانية (302.1 مقاسة، عالية) | "نفس السرعة تقريبًا" وفقًا لجوجل |
| مؤشر ذكاء Artificial Analysis | 59 (عالي) | 56 (عالي) |
| حالة الدعم | حالي | "لا يزال مدعومًا بالكامل"، لا يوجد تاريخ إيقاف |
ما هو متطابق
السعر، أولًا. كلا النموذجين يقعان في نفس الصفوف على صفحة تسعير جوجل: 0.75 دولار للإدخال و 3.75 دولار للإخراج حتى 31 ديسمبر، ويتضاعف إلى 1.50 دولار و 7.50 دولار في 1 يناير 2027. كما أن التخزين المؤقت، وخصومات الدفعات، و 5000 طلب مجاني لتأسيس بحث جوجل شهريًا (مشتركة عبر كل نموذج من نماذج Gemini 3.x) كلها تنتقل. إذا كنت تريد تفصيلًا لكل سطر، فإن مرجع مواصفات وأسعار 3.7 Flash لا يزال ينطبق على 3.8 Flash سطرًا بسطر.
حدود السياق والإخراج لم تتغير عند 1,048,576 رمز إدخال و 65,536 رمز إخراج. والأنماط هي نفسها أيضًا: نص، صورة، فيديو، صوت، و PDF كإدخال؛ ونص كإخراج. لا يقوم أي من النموذجين بتوليد الصوت، أو توليد الصور، أو واجهة برمجة التطبيقات المباشرة (Live API).
السرعة شبه متساوية. وصف لوغان كيلباتريك من جوجل نموذج 3.8 Flash بأنه "نفس سعر 3.7، وبنفس السرعة تقريبًا." قامت Artificial Analysis بقياس 302.1 رمز إخراج في الثانية في تشغيلها عالي الاستدلال. وهذا هو الإنتاجية بمجرد أن يبدأ النموذج في الكتابة؛ وكان وقت الوصول إلى أول رمز في نفس التشغيل 13.30 ثانية، لأن النموذج في مستوى high يفكر قبل أن يتحدث.
واجهة برمجة التطبيقات (API) هي نفسها أيضًا. تُعد Interactions API هي المسار الأساسي لجوجل لنموذج Gemini 3.x الآن، ونقطة النهاية القديمة generateContent "لا تزال مدعومة بالكامل" بدون تاريخ إيقاف. تعمل الشيفرة المكتوبة لـ 3.7 Flash على أي من نقطتي النهاية مع gemini-3.8-flash بعد تبديل سلسلة النموذج، مع الاستثناءات المشمولة تحت التغييرات الجذرية.
ما الذي تحسن
عنوان جوجل لنموذج 3.8 Flash هو "نموذج Flash الأكثر ذكاءً لدينا"، والذي تم تصميمه لـ "هندسة البرمجيات ذات الأفق الطويل، والوكلاء المستقلين، وسير العمل المعقد في الشركات". التغيير التصميمي وراء هذا الادعاء: في المهام الصعبة، يقوم النموذج "بتنفيذ خطوات استدلال إضافية، ويستدعي الأدوات بشكل متكرر"، متخذًا "خطوات استدلال أصغر" ويتحقق من "عمله على طول الطريق". إليك ما ينتج عن ذلك على المقاييس المعيارية التي نشرتها جوجل وArtificial Analysis في النص.
جداول جوجل الخاصة. نشرت جوجل ثلاث مقارنات رقمية ضد 3.7 Flash على صفحة DeepMind Flash. هذه المقارنات أجراها البائع.
| المقياس المعياري (تشغيل جوجل) | 3.8 Flash | 3.7 Flash | الفارق |
|---|---|---|---|
| وكيل Vals Finance v2 | 61.4% | 59.0% | +2.4 |
| HLE-Verified | 54.9% | 53.6% | +1.3 |
| مقياس Harvey Legal Agent | 10.0% | 8.8% | +1.2 |
مكاسب متواضعة ومتسقة، وفي كل صف يتفوق 3.8 Flash أيضًا على النماذج الأكبر في جدول جوجل (Claude Opus 5 بنسبة 58.6% على Vals Finance، و 54.4% على HLE-Verified)؛ المقارنة الثلاثية مع Claude Fable 5.1 و GPT-5.6 Sol تتابع هذا الخيط. هذا يعني أن نموذجًا بسعر Flash يتفوق على نماذج تكلف عدة أضعاف لكل رمز، وهذا هو ما ترغب جوجل في أن تستخلصه.
Artificial Analysis، بشكل مستقل. مقال Artificial Analysis يضع 3.8 Flash عند 59 على مؤشر الذكاء الخاص به في مستوى high، ارتفاعًا من 56 لـ 3.7 Flash و 52 لـ 3.6 Flash. هذا يعني ثلاث نقاط لكل إصدار، ويربط 3.8 Flash مع GPT-5.6 Sol عند مستوى xhigh و Grok 4.6 عند مستوى medium، ونقطة واحدة فوق Claude Fable 5.1 عند مستوى medium. في τ³-Banking، تقييم استخدام الأدوات الخاص به، سجل 3.8 Flash 45%، قفزة قدرها 12 نقطة عن 3.7 Flash. إذا كنت تشغل وكلاء باستدعاءات أدوات حقيقية، فإن هذا الصف يهم أكثر من المؤشر.
أعمال الوكلاء الثقيلة بالوثائق. تقول جوجل إن 3.8 Flash "يكمل أكثر من ثلاثة أضعاف عدد المهام التي يكملها Gemini 3.7 Flash" في سير العمل الطويلة والمكثفة بالوثائق. إنه تقييم داخلي، ولا يوجد نظام اختبار عام، لذا تعامل معه كدليل اتجاهي. ومع ذلك، فإنه يتماشى مع تصميم النموذج: خطوات التحقق الإضافية تساعد أكثر حيث يؤدي خطأ واحد إلى إعاقة مهمة من 40 خطوة.
الترميز، مع وجود فجوة في السجل. في DeepSWE v1.1، سجل 3.7 Flash 65.3%، ارتفاعًا من 49.0% على 3.6 Flash. تقول جوجل إن 3.8 Flash "يتفوق على معظم النماذج الحدودية الأكبر" هناك "بجزء بسيط من التكلفة"، لكن النسبة المئوية الدقيقة لـ 3.8 تظهر فقط في جداول الصور ببطاقة النموذج، وليس في النص، لذلك لن نطبع رقمًا. لم يتم نشر أرقام SWE-Bench Pro و Terminal-bench و OSWorld لـ 3.8 Flash في النص على الإطلاق. إذا كانت هذه المقاييس المعيارية تدفع قرارك، فانتظر عمليات تشغيل من طرف ثالث.
السلامة ومقاومة الحقن. تفيد جوجل عن "قفزة كبيرة" في اختبار حقن الأوامر (prompt-injection) في Gray Swan بدون رقم. الفروقات في بطاقة النموذج مقابل 3.7 Flash صغيرة: سلامة متعددة اللغات +5.4 نقطة، سلامة النص إلى نص -0.4، رفض غير مبرر +1.1. اقرأ النقطة الأخيرة على أنها زيادة طفيفة في الرفض المفرط.
ما يكلفك
أسعار الرموز الفردية لم تتغير. لكن تكلفة المهمة تغيرت. هذا هو المقايضة التي تذكرها جوجل صراحة: يمكن للنموذج "استخدام المزيد من الرموز في المهام الأطول والأكثر تعقيدًا، حسب التصميم"، و"قد يستخدم المزيد من الرموز لزيادة الأداء إلى أقصى حد، خاصة في مستويات الجهد الأعلى."
قامت Artificial Analysis بقياس ذلك كميًا. عند تشغيل مؤشرها، بلغ متوسط 3.8 Flash 48,000 رمز إخراج لكل مهمة، أي بزيادة 30% عن 3.7 Flash. وبأسعار الرموز المتطابقة، يتحول ذلك إلى فاتورة أعلى لكل مهمة مكتملة:
| التكوين (Artificial Analysis) | التكلفة لكل مهمة | الوقت لكل مهمة |
|---|---|---|
Gemini 3.7 Flash, high |
0.40 دولار | 2.2 دقيقة |
Gemini 3.8 Flash, low |
0.24 دولار | 0.8 دقيقة |
Gemini 3.8 Flash, medium |
0.41 دولار | لم تُنشر |
Gemini 3.8 Flash, high |
0.58 دولار | 2.5 دقيقة |
تستنتج ثلاثة أشياء من هذا الجدول. أولًا، يكلف 3.8 Flash في مستوى high حوالي 45% أكثر لكل مهمة من 3.7 Flash في مستوى high، ويستغرق وقتًا فعليًا أطول بنسبة 14%. ثانيًا، 3.8 Flash في مستوى medium، وهو الافتراضي، يقترب بفرق سنت واحد من 3.7 Flash في مستوى high، لذا فإن ترقية "بنفس الميزانية" متاحة إذا كانت جودة medium تلبي متطلباتك. ثالثًا، 3.8 Flash في مستوى low هو الصف الأقل تكلفة والأسرع في الجدول، مما يجعله الخيار الواضح للمسارات الحساسة للكمون حيث كان 3.7 Flash يعمل في مستوى high من باب العادة.
تفاصيل تسعير 3.8 Flash تحول هذا إلى أحجام يومية. باختصار: إذا كنت تدفع لكل مهمة، فإن الترقية ليست مجانية، ومستوى التفكير هو المفتاح الذي تستخدمه لتحديد مقدار التحسين الذي تشتريه.
تغييرات جذرية موجزة
يؤثر تغييران بشكل مباشر على كود 3.7 Flash الحالي.
يعيد `thinking_level: "minimal"` خطأ في التحقق. يقبل 3.8 Flash مستويات low و medium و high فقط. إذا كان تكوين 3.7 يتضمن minimal، فقم بتحويله إلى low. يغطي دليل مستويات التفكير ما يفعله كل مستوى وتكلفة وكمون كل منها.
يجب أن تحمل استجابات الوظائف call_id و name. تحتاج كل function_result في Interactions API إلى هذين الحقلين، وتحتاج كل functionResponse في generateContent القديمة إلى id المطابق بالإضافة إلى name. ستفشل الشيفرة التي أعادت النتائج بناءً على الاسم فقط في الدورة الثانية من حلقة الأداة.
بالإضافة إلى ذلك، يرشد دليل ترحيل 3.7 إلى 3.8 Flash عبر قواعد Gemini 3 التي تستحق إعادة التحقق منها أثناء الانتقال: حافظ على `temperature` عند القيمة الافتراضية 1.0 (تحذر جوجل من أن القيم الأقل "قد تسبب حلقات أو أداءً متدهورًا")، استخدم `thinking_level` بدلاً من `thinking_budget` كعدد صحيح، أسقط `candidate_count`، ومرر توقيعات التفكير مرة أخرى كما تم استلامها بالضبط. لا شيء من هذه الأشياء جديد على 3.8، ولكن قاعدة شيفرة 3.7 التي تجاهلتها ستظهر المشاكل الآن.
مصفوفة القرار حسب عبء العمل
| عبء العمل | التوصية | لماذا |
|---|---|---|
| الوكلاء متعددو الخطوات مع استدعاءات الأدوات | الترقية، medium أو high |
+12 على τ³-Banking؛ الحلقات التكرارية للأدوات هي جوهر 3.8 |
| استخراج ومراجعة المستندات الطويلة | الترقية | مطالبة جوجل بإنجاز المهام بمعدل 3x تستهدف هذا الشكل تحديدًا |
| الترميز الآلي في بيئة اختبار | الترقية، ثم القياس | لم يُنشر رقم DeepSWE النصي؛ تحقق على مستودعك قبل الالتزام |
| وكلاء المالية والقانون والبحث | الترقية | جميع جداول جوجل المنشورة الثلاثة تميل لصالح 3.8 |
| التصنيف، الاستخراج، الدردشة عالية الحجم | البقاء على 3.7، أو 3.8 في مستوى low |
التكلفة لكل مهمة هي المقياس هنا؛ low أرخص من 3.7 في high |
| نقاط النهاية التي يواجهها المستخدم الحساسة للكمون | 3.8 في مستوى low |
0.8 دقيقة لكل مهمة على بيئة اختبار AA مقابل 2.2 لـ 3.7 في high |
أي شيء يستخدم التفكير minimal |
الترحيل أولًا | خطأ في التحقق حتى تقوم بتحويله إلى low |
| خطوط أنابيب الدفعة المسعرة بالدقة | البقاء على 3.7 حتى إعادة القياس | نفس سعر الرمز الواحد، ولكن +30% من رموز الإخراج يغير فاتورة الدفعة |
النمط: كلما كانت المهمة أصعب وأطول، كلما كسب تصميم 3.8 Flash الذي "يعمل بجهد أكبر" رموزه أكثر. وكلما كانت المهمة أقصر وأكثر تكرارية، قل ما يفعله، وزاد أهمية مستوى التفكير (أو البقاء على الوضع الحالي).
اختبر كلا النموذجين على نفس سيناريو الاختبار في Apidog
الأرقام لكل مهمة المذكورة أعلاه تأتي من بيئة اختبار Artificial Analysis، وليست من بيئة اختبارك. قبل تبديل سلسلة النموذج في الإنتاج، قم بتشغيل طلباتك الخاصة عبر كلا النموذجين وقارن عدد الرموز. Apidog يجعل هذا الأمر مهمة تستغرق عشر دقائق.
اضبط `GEMINI_API_KEY` كمتغير بيئة في بيئة Apidog وأضف طلب POST واحد إلى `https://generativelanguage.googleapis.com/v1beta/models/{{model}}:generateContent` مع `x-goog-api-key` يقرأ من المتغير. اجعل `model` متغير سيناريو أيضًا. يكون الجسم (body) هو نفسه لكلا التشغيلين:
{
"contents": [{"parts": [{"text": "{{golden_prompt}}"}]}],
"generationConfig": {"thinkingConfig": {"thinkingLevel": "medium"}}
}
قم ببناء سيناريو اختبار بخطوتين: الطلب مع تعيين `model` على `gemini-3.7-flash`، ثم نفس الطلب مع `gemini-3.8-flash`. في كل خطوة، أضف تأكيدات على `usageMetadata.candidatesTokenCount` و `usageMetadata.thoughtsTokenCount` بحد أقصى يعكس ميزانيتك، بالإضافة إلى تأكيد مسار JSON على أي حقل تقرأه تطبيقك. قم بتشغيل السيناريو مقابل مجموعة بيانات من عشرة أو عشرين طلبًا ذهبيًا. يعرض تقرير الاختبار استجابة كل خطوة ونتائج التأكيد معًا، بحيث تقرأ عدد الرموز لكلا النموذجين من تشغيل واحد ويصبح رقم +30% هو رقمك بدلاً من رقم مقياس معياري.
بمجرد أن تبدو الأرقام صحيحة، قم بجدولة السيناريو بحيث يؤدي أي زيادة بسيطة في رموز التفكير بعد تحديث النموذج إلى فشل الاختبار بدلاً من الظهور على الفاتورة. قم بتنزيل Apidog لإعداده؛ الخطة المجانية تغطي سير العمل هذا.
الأسئلة الشائعة
هل Gemini 3.8 Flash أسرع من 3.7 Flash؟
لا. وصف جوجل الخاص هو "نفس السرعة تقريبًا"، وقدرت Artificial Analysis حوالي 300 رمز إخراج في الثانية في مستوى high. لأن 3.8 Flash يستدل في خطوات أكثر، فقد ازداد الوقت الفعلي لكل مهمة في بيئة الاختبار الخاصة به (2.5 دقيقة مقابل 2.2 في مستوى high). يؤدي التخفيض إلى low إلى خفضه إلى 0.8 دقيقة.
هل يكلف Gemini 3.8 Flash أكثر من 3.7 Flash؟
ليس لكل رمز. كلاهما بسعر 0.75 دولار للإدخال و 3.75 دولار للإخراج حتى 31 ديسمبر، ثم 1.50 دولار و 7.50 دولار. أما لكل مهمة، فنعم: قدرت Artificial Analysis 0.58 دولار في مستوى high مقابل 0.40 دولار لـ 3.7 Flash في مستوى high، لأن 3.8 Flash يكتب حوالي 30% المزيد من رموز الإخراج.
هل ستقوم جوجل بإيقاف Gemini 3.7 Flash؟
تقول جوجل إن 3.7 Flash "لا يزال مدعومًا بالكامل" ولم تنشر أي تاريخ لإيقافه. يمكنك البقاء عليه. لا يزال منشور ما الجديد في 3.7 Flash هو المرجع لهذا النموذج.
ما الذي سيتعطل عند التبديل إلى 3.8 Flash؟
أمرين: `thinking_level: "minimal"` يعيد الآن خطأ `400 INVALID_ARGUMENT`، ويجب أن تتضمن كل استجابة دالة كلاً من معرف الاستدعاء (`call_id` على Interactions API، `id` على `generateContent` القديمة) و`name`. كل شيء آخر في Gemini 3 API لم يتغير.
كيف تقارن هذه القفزة بالانتقال من 3.6 إلى 3.7؟
كان 3.7 Flash خطوة أكبر: ارتفع DeepSWE من 49.0% إلى 65.3%، ومؤشر Artificial Analysis من 52 إلى 56. أما خطوة 3.8 فهي +3 على المؤشر وإعادة تصميم لكيفية استهلاك النموذج للرموز. للجيل الأسبق، انظر 3.6 Flash مقابل 3.5 Flash، والذي يغطي تخفيض الأسعار الذي بدأ هذه السلسلة من الإصدارات.
النسخة المختصرة
قم بالترقية إذا كان عبء عملك قائمًا على الوكلاء، أو كثيف الأدوات، أو كثيف المستندات. هذا هو المكان الذي تظهر فيه جوجل وArtificial Analysis مكاسب، وحيث تشتري الرموز الإضافية مهامًا مكتملة. ابق على 3.7 Flash، أو انتقل إلى 3.8 بمستوى low، إذا كنت تقوم بإجراء استدعاءات قصيرة ومتكررة حيث تكون تكلفة المهمة هي الرقم الذي تبلغه. في كلتا الحالتين، قم بإصلاح minimal وتحقق من استجابات وظائفك أولًا، ثم قم بقياس عدد الرموز على طلباتك الخاصة قبل أن تثق بأي بيئة اختبار، بما في ذلك بيئتنا.
