Gemini 3.8 Flash هو أحدث نموذج من فئة Flash من Google، تم إصداره في 2 سبتمبر 2026، جنبًا إلى جنب مع توأم أمني مغلق يسمى Gemini 3.8 Flash Cyber. إنه الإصدار الثالث من Flash في غضون ستة أسابيع، بعد Gemini 3.6 Flash في 21 يوليو و3.7 Flash في 13 أغسطس، بنفس السعر التمهيدي لـ 3.7 Flash: 0.75 دولار لكل مليون رمز إدخال و3.75 دولار لكل مليون رمز إخراج حتى 31 ديسمبر 2026. تصفه Google بأنه "أذكى نماذج Flash لدينا، المصمم للهندسة البرمجية طويلة المدى، والوكلاء المستقلين، وسير العمل المعقد للمؤسسات."
التغيير الرئيسي ليس سعرًا جديدًا أو نافذة سياق أكبر. إنه سلوك. صممت Google نموذج 3.8 Flash "للعمل بجد أكبر" في المهام الصعبة: فهو يتخذ خطوات استدلال أصغر، ويتحقق من عمله على طول الطريق، ويستدعي الأدوات بشكل متكرر. وهذا يحقق مكاسب قابلة للقياس في معايير الوكلاء، ويعني أن النموذج يستهلك المزيد من الرموز لكل مهمة، حسب التصميم. قدرت شركة Artificial Analysis زيادة بنسبة 30% تقريبًا في رموز الإخراج مقارنة بـ 3.7 Flash. إذا كانت ميزانيتك بالرمز، فالسعر ثابت. وإذا كانت ميزانيتك بالمهمة، فقد ارتفعت الفاتورة.
يغطي هذا الدليل الإطلاق بالكامل: المواصفات، والمفاضلة "يعمل بجد أكبر"، والمعايير، والتسعير، والتوافر، والتوأم سايبر، وما لا يمكن للنموذج فعله. كل طلب هنا هو HTTP عادي مع JSON، لذا يمكنك بناؤها وفحصها في Apidog قبل أن تصل إلى كود التطبيق. تُعد مشاركة إطلاق Google وصفحة النموذج هي المصادر الأساسية.
نظرة سريعة على Gemini 3.8 Flash
| المواصفات | القيمة |
|---|---|
| معرف نموذج API | gemini-3.8-flash (مستقر، بدون لاحقة معاينة) |
| تاريخ الإصدار | 2 سبتمبر 2026 |
| يعتمد على | Gemini 3.7 Flash (وفقًا لبطاقة نموذج DeepMind) |
| نافذة السياق | 1,048,576 رمز إدخال |
| الحد الأقصى للإخراج | 65,536 رمز |
| طرق الإدخال | نص، صورة، فيديو، صوت، PDF |
| طرق الإخراج | نص فقط |
| مستويات التفكير | low، medium (افتراضي)، high؛ minimal يُرجع خطأ |
| السعر التمهيدي (حتى 31 ديسمبر 2026) | 0.75 دولار إدخال / 3.75 دولار إخراج لكل مليون رمز؛ يتم احتساب التفكير كإخراج |
| السعر القياسي (اعتبارًا من 1 يناير 2027) | 1.50 دولار إدخال / 7.50 دولار إخراج لكل مليون رمز |
| تخزين السياق المؤقت | 0.075 دولار لكل مليون رمز مخزن مؤقتًا (تمهيدي)، 0.15 دولار قياسي |
| Batch API (واجهة برمجة تطبيقات الدفعات) | خصم 50%: 0.375 دولار / 1.875 دولار تمهيدي |
| حد المعرفة | مارس 2026 |
| توفر للمطورين | Gemini API، Google AI Studio، Android Studio، Google Antigravity، Stitch، Gemini Enterprise |
| توفر للمستهلكين | تطبيق Gemini (لمشتركي AI Pro و Ultra)، وضع AI في البحث، Gemini في Google Sheets |
| حالة 3.7 Flash | لا يزال مدعومًا بالكامل؛ لا يوجد تاريخ لإيقافه |
ثلاثة صفوف تستحق نظرة ثانية. مستوى التفكير الافتراضي هو medium، وليس high كما في Gemini 3 Pro، لذا فإن المطالبة التي تم ضبطها على Pro تستدل بشكل أقل هنا ما لم تقم بتعيين المستوى. يعيد مستوى minimal خطأ تحقق بدلاً من التعيين الصامت إلى low؛ يغطي دليل مستويات التفكير الإصلاح. ويحمل تاريخ قطع المعرفة في مارس 2026 تحذيرًا من بطاقة النموذج: في بعض المجالات، قد تكون المعرفة محدودة حتى يناير 2025.
ما هو Gemini 3.8 Flash
Flash هي فئة العمل الشاقة من Google: النموذج المخصص لتشغيل معظم حركة المرور الإنتاجية بينما يتعامل Pro مع أصعب المشكلات. تسمي Google نموذج 3.8 Flash "أذكى نماذج العمل الشاقة لدينا حتى الآن"، وتصفه بطاقة نموذج DeepMind بأنه يعتمد على 3.7 Flash بدلاً من نموذج أساسي جديد. لذا، فإن التصوير الصادق هو تحسين لنموذج تم إصداره قبل ثلاثة أسابيع، تم ضبطه للهندسة البرمجية طويلة الأمد وعمل الوكلاء.

الإيقاع غير عادي. وصل 3.6 Flash في 21 يوليو بسعر 1.50 دولار / 7.50 دولار، و3.7 Flash في 13 أغسطس بالسعر التمهيدي 0.75 دولار / 3.75 دولار، و3.8 Flash في 2 سبتمبر بنفس السعر. صياغة Google هي "الإصدار الثالث من Flash في غضون ستة أسابيع"؛ تعد Artificial Analysis نموذج Flash رابعًا في أقل من أربعة أشهر لأن حسابها يتضمن 3.5 Flash-Lite. لأي شخص يقوم بصيانة تكوين نموذج، فإن منشور "ما الجديد في 3.7 Flash" عمره ثلاثة أسابيع ويصف بالفعل الجيل السابق. لم يتم شحن أي Gemini 3.8 Pro أو Gemini 4 أو Flash-Lite جديد مع هذا الإصدار، ولم تذكر Google متى سيأتي تحديث Pro.
تصميم "يعمل بجد أكبر" وما يكلفك
وصف Google للتغيير محدد. في المهام المعقدة، ينفذ 3.8 Flash "خطوات استدلال إضافية، ويستدعي الأدوات بشكل متكرر." ويأخذ "خطوات استدلال أصغر" و"يتحقق من عمله على طول الطريق." Google صريحة بشأن النتيجة: النموذج "يمكنه استخدام المزيد من الرموز في المهام الأطول والأكثر تعقيدًا، حسب التصميم،" خاصة عند مستويات الجهد الأعلى.
قاست Artificial Analysis ذلك في تقريرها المستقل. عند تشغيل مؤشر الذكاء الخاص بهم، بلغ متوسط 3.8 Flash عند الاستدلال العالي 48,000 رمز إخراج لكل مهمة، بزيادة 30% عن 3.7 Flash. لم تتغير الأسعار لكل رمز، لذا ارتفعت التكلفة لكل مهمة من 0.40 دولار في 3.7 Flash عالية إلى 0.58 دولار في 3.8 Flash عالية. ارتفع الوقت المستغرق لكل مهمة أيضًا: 2.5 دقيقة مقابل 2.2 دقيقة.
يُظهر نفس التقرير الرافعة التي تملكها. عند medium، تنخفض التكلفة لكل مهمة إلى 0.41 دولار، وهو قريب من 3.7 Flash في المستوى العالي. عند low، تنخفض إلى 0.24 دولار مع 0.8 دقيقة لكل مهمة. لذا، فإن مستوى التفكير أصبح الآن قرار توجيهي، وليس إعدادًا عامًا: نقاط نهاية حساسة للكمون على low، وحلقات الوكلاء التي يجب أن تنهي المهمة على medium أو high. يوضح تفصيل الأسعار 1000 مهمة وكيل يوميًا لكل مستوى.
السرعة لم تتغير. وصف لوجان كيلباتريك من Google نموذج 3.8 Flash بأنه "بنفس سعر 3.7، وبنفس السرعة تقريبًا،" وقدرت Artificial Analysis 302.1 رمز إخراج في الثانية عند الاستدلال العالي. وقتهم البالغ 13.30 ثانية لأول رمز في تلك العملية هو وقت تفكير النموذج قبل الإجابة، وليس مسار شبكة بطيء.
ما تقوله المعايير
نشرت Google ثلاثة جداول معيارية بصيغة نصية على صفحة DeepMind Flash. هذه أرقام تديرها Google.
| المعيار | 3.8 Flash | 3.7 Flash | Claude Opus 5 | GPT-5.6 Sol | GPT-5.6 Terra | Claude Sonnet 5 |
|---|---|---|---|---|---|---|
| Vals Finance Agent v2 | 61.4% | 59.0% | 58.6% | 53.8% | 54.4% | 53.9% |
| Harvey Legal Agent Benchmark | 10.0% | 8.8% | 6.7% | 2.5% | 0.8% | 5.0% |
| HLE-Verified | 54.9% | 53.6% | 54.4% | 54.5% | 51.1% | 31.0% |
المكاسب على 3.7 Flash هي 2.4 و1.2 و1.3 نقطة. متواضعة، لكن صفوف التمويل والقانون تضع نموذجًا بسعر Flash متقدمًا على Opus 5 وGPT-5.6 Sol، واللذين يكلفان عدة أضعاف لكل رمز. لا يظهر Claude Fable 5.1، الذي تم شحنه في اليوم السابق، في جداول Google؛ تستخدم المقارنة الثلاثية صفي Opus 5 وSonnet 5 من Anthropic كأقرب الإدخالات المنشورة.
تقدم Google ثلاث ادعاءات أخرى بدون أرقام نصية. في DeepSWE v1.1، يتفوق 3.8 Flash "على معظم النماذج الحدودية الأكبر" بـ "جزء صغير من التكلفة"؛ تظهر النسبة المئوية فقط في جداول الصور ببطاقة النموذج، لذا لن نقوم بطباعتها (سجل 3.7 Flash 65.3%). في سير العمل طويل الأمد الذي يعتمد على المستندات، يظهر تقييم داخلي أنه "يكمل أكثر من ثلاثة أضعاف المهام التي يكملها Gemini 3.7 Flash." وفي حقن المطالبات Gray Swan، تفيد Google بـ "قفزة كبيرة" بدون رقم. لم يتم نشر نتائج SWE-Bench Pro وTerminal-bench وOSWorld نصيًا لـ 3.8 Flash.
تتوافق النظرة المستقلة. تسجل Artificial Analysis نموذج 3.8 Flash (مرتفع) بـ 59 على مؤشر الذكاء الخاص بهم، ارتفاعًا من 56 لـ 3.7 Flash و52 لـ 3.6 Flash. وهذا يتعادل مع GPT-5.6 Sol (xhigh) وGrok 4.6 (متوسط)، ويقع فوق GPT-5.6 Terra (أقصى)، وClaude Fable 5.1 (متوسط)، وMuse Spark 1.2 (xhigh)، وجميعها عند 57. في تقييم استخدام الأدوات τ³-Banking الخاص بهم، سجل 3.8 Flash 45%، بزيادة 12 نقطة عن 3.7 Flash. تقارن مقارنة 3.8 مقابل 3.7 Flash هذه المكاسب بتكلفة الرمز حسب عبء العمل.
التسعير: نفس السعر لكل رمز، المزيد لكل مهمة
تُدرج صفحة التسعير 3.8 Flash في نفس الصفوف مثل 3.6 و3.7 Flash، وجميعها تتضاعف في 1 يناير 2027.
| البند | حتى 31 ديسمبر 2026 | اعتبارًا من 1 يناير 2027 |
|---|---|---|
| الإدخال | 0.75 دولار / مليون | 1.50 دولار / مليون |
| الإخراج (يشمل التفكير) | 3.75 دولار / مليون | 7.50 دولار / مليون |
| الإدخال المخزن مؤقتًا | 0.075 دولار / مليون | 0.15 دولار / مليون |
| تخزين الذاكرة المؤقتة | 0.50 دولار / مليون رمز / ساعة | 1.00 دولار / مليون رمز / ساعة |
| إدخال / إخراج الدُفعات | 0.375 دولار / 1.875 دولار | 0.75 دولار / 3.75 دولار |
تفصيلان يوقعان الناس في الخطأ. رموز التفكير هي رموز إخراج: تُحاسب بسعر الإخراج وتُبلغ عنها بشكل منفصل في usageMetadata.thoughtsTokenCount، لذا قد تكلف إجابة قصيرة بمستوى high أكثر من إجابة طويلة بمستوى low. ولدى ترسيخ بحث Google مقياسه الخاص: 5000 طلب مجاني شهريًا مشتركًا عبر جميع نماذج Gemini 3.x، ثم 14 دولارًا لكل 1000 طلب.
توجد طبقة مجانية محدودة المعدل في AI Studio وواجهة برمجة التطبيقات، مع إشارة Google إلى أن بيانات الطبقة المجانية "تُستخدم لتحسين منتجاتنا." تظهر حدود المعدل لكل نموذج في AI Studio بدلاً من الوثائق. تُفتح الطبقة 1 بربط حساب فوترة، والطبقة 2 بعد إنفاق 100 دولار وثلاثة أيام، والطبقة 3 بعد 1000 دولار و30 يومًا. يغطي دليل الوصول المجاني ما تتيحه لك المسارات المجانية وما لا تتيحه، ويغطي دليل Batch API خصم الـ 50% للوظائف التي يمكن أن تنتظر.
كيفية استدعائه
تعتبر Google الآن واجهة برمجة تطبيقات التفاعلات (Interactions API) المسار الأساسي لـ Gemini 3.x. يُعد generateContent "قديمًا" ولكنه "لا يزال مدعومًا بالكامل" بدون تاريخ إيقاف، وما زالت معظم الأكواد الحالية تستخدمه. طلب تفاعلات بسيط:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"medium"}}'
تمرر المحادثات متعددة الأدوار previous_interaction_id وتسمح للخادم بالاحتفاظ بالحالة. يُعلن استدعاء الدالة عن الأدوات باستخدام مخطط JSON، ويتلقى خطوة function_call، ويتوقع function_result يحمل كلًا من call_id و name، وهما مطلوبان في 3.8 Flash (تستخدم generateContent القديمة حقل id). يوضح شرح واجهة برمجة التطبيقات كلا نقطتي النهاية في REST وPython، ويغطي دليل استدعاء الدوال حلقات الأدوات التكرارية التي ينتجها تصميم "يعمل بجد أكبر" وكيفية تحديدها.
إذا كنت تنتقل من 3.7 Flash، فإن التغييرات صغيرة ولكنها تسبب أخطاء: يتم رفض التفكير minimal، ويحل thinking_level محل thinking_budget، ولا يتم دعم candidate_count، وتقول Google أن تترك temperature عند القيمة الافتراضية 1.0 لأن خفضها "قد يسبب تكرارًا أو أداءً متدهورًا." يحول دليل الترحيل ملاحظات Google حول "ما الجديد" إلى قائمة تحقق مع JSON قبل وبعد.
ما لا يستطيع Gemini 3.8 Flash فعله
توضح صفحة النموذج ذلك صراحةً. غير مدعوم: توليد الصوت، واجهة برمجة تطبيقات Live، وتوليد الصور. الإخراج نصي فقط، على الرغم من أن الإدخال يقبل النص والصور والفيديو والصوت وPDF. لا يتم دعم تجزئة الصور في نماذج Gemini 3 أيضًا. إذا كان منتجك يحتاج إلى إخراج صوتي أو بصري في الوقت الفعلي، فإن هذا النموذج هو طبقة الاستدلال واستدعاء الأدوات، وليس المكدس بأكمله. بالنسبة للنصوص الرخيصة وعالية الإنتاجية بدون استدلال مكثف، يبقى Gemini 3.5 Flash-Lite في قائمة الأسعار بسعر 0.30 دولار / 2.50 دولار. بقية قائمة التحقق مدعومة، بما في ذلك استدعاء الدوال، والمخرجات المنظمة، وتخزين السياق المؤقت، وتنفيذ الكود، وترسيخ البحث والخرائط، وBatch API، واستخدام الكمبيوتر في المعاينة.
Gemini 3.8 Flash Cyber: التوأم المغلق
تم شحن Gemini 3.8 Flash Cyber في نفس اليوم، ولا يمكنك التسجيل فيه. يتاح الوصول فقط من خلال برنامج Fairwind الجديد، المفتوح لـ "الجهات الحكومية الموثوقة، ومشغلي البنية التحتية الحيوية، ومطوري البرمجيات"، مع إجراء فحوصات خلفية ومتطلبات مثل المصادقة متعددة العوامل المقاومة للتصيد الاحتيالي. لا توجد واجهة برمجة تطبيقات عامة، ولا تسعير عام، ولا استضافة ذاتية. إنه يحل محل النسخة التجريبية المحدودة 3.5 Flash Cyber.
ادعاءات Google كبيرة: معدل نجاح اكتشاف الثغرات الأمنية في العالم الحقيقي يزيد عن 70% عبر 20 لغة برمجة، وتقرير فريق أمان Chrome يفيد بـ "2.6 مرة تصحيحات أكثر دقة للثغرات الأمنية في Chrome من أفضل النماذج التجارية الأكبر بكثير." كلاهما مُبلغ عنه من Google. يغطي شرح Cyber الأهلية والالتزامات وما يعنيه ذلك للعديد من الفرق التي لن تحصل على إمكانية الوصول.
اختبار طلبات Gemini 3.8 Flash في Apidog
نظرًا لأن قصة التكلفة تعتمد على المهمة بدلاً من الرمز، فإن الاختبار المفيد ليس "هل نجح الاستدعاء" بل "كم عدد الرموز التي استهلكها." يتعامل Apidog مع ذلك كاختبار API عادي. قم بتخزين GEMINI_API_KEY كمتغير بيئة، واحفظ طلبات Interactions وgenerateContent كنقاط نهاية، وتحقق من حالة 200، وحقول JSON التي يقرأها تطبيقك، وحد أقصى لـ usageMetadata.thoughtsTokenCount. قم بتشغيل نفس المطالبة بمستويات low وmedium وhigh في سيناريو اختبار واحد وستحصل على توزيع الرموز لكل مستوى لمطالباتك الخاصة بدلاً من متوسطات Artificial Analysis.
تُعرض الاستجابات المتدفقة كـ SSE، مما يساعد عند تصحيح أخطاء ملخصات الأفكار باستخدام includeThoughts: true؛ يشرح دليل اختبار SSE ذلك. قم بجدولة السيناريو يوميًا وفشل تراجع الرموز يؤدي إلى فشل تحقق قبل أن يظهر في الفاتورة. قم بتنزيل Apidog لإعداده على الخطة المجانية.
الأسئلة الشائعة
هل Gemini 3.8 Flash نموذج جديد أم تحديث لـ 3.7 Flash؟ تقول بطاقة نموذج DeepMind إنه يعتمد على Gemini 3.7 Flash. اعتبره خليفًا مُعدّلًا: نفس السعر والسرعة ونافذة السياق، مع المزيد من خطوات الاستدلال واستدعاء الأدوات في المهام الصعبة. يظل 3.7 Flash مدعومًا بالكامل، بدون تاريخ إيقاف.
لماذا يستخدم Gemini 3.8 Flash رموزًا أكثر من 3.7 Flash؟ حسب التصميم. تقول Google إنه "يمكنه استخدام المزيد من الرموز في المهام الأطول والأكثر تعقيدًا،" وقدرت Artificial Analysis زيادة بنسبة 30% في رموز الإخراج على مؤشرها. اخفض thinking_level إلى medium أو low على المسارات التي لا تحتاج إلى استدلال إضافي؛ يحتوي دليل مستويات التفكير على جدول التكلفة لكل مستوى.
ما هي نافذة سياق Gemini 3.8 Flash؟ 1,048,576 رمز إدخال و65,536 رمز إخراج، مع تخزين السياق المؤقت بسعر 0.075 دولار لكل مليون رمز مخزن مؤقتًا حتى 31 ديسمبر 2026.
هل يمكنني استخدام Gemini 3.8 Flash في تطبيق Gemini المجاني؟ تغطي معلومات الإطلاق تطبيق Gemini لمشتركي Google AI Pro و Ultra، وليس الطبقة المجانية من التطبيق. يحصل المطورون على طبقة مجانية محدودة المعدل في AI Studio وواجهة برمجة التطبيقات.
كيف يقارن Gemini 3.8 Flash بـ Claude Fable 5.1؟ تسجل Artificial Analysis لهما 59 و 57. بالنسبة للسعر، يكلف Claude Fable 5.1 10 دولارات / 50 دولارًا لكل مليون رمز، أي حوالي 13 ضعف السعر التمهيدي لـ 3.8 Flash لكل من الإدخال والإخراج. تضيق الفجوة بمجرد حساب الرموز لكل مهمة.
إلى أين نذهب بعد ذلك
Gemini 3.8 Flash هو نموذج قوي يفكر لفترة أطول، والمفاضلة واضحة: نقاط قليلة إضافية في معايير الوكلاء و12 نقطة في استخدام الأدوات، مدفوعة بحوالي 30% المزيد من رموز الإخراج عند الاستدلال العالي. إذا كانت وكلاؤك يواجهون صعوبة مع 3.7 Flash، فإن الترقية تكلف نفس السعر لكل رمز. إذا كانت حركة المرور الخاصة بك هي محادثة حساسة للكمون، اضبط low أو ابق على 3.7 Flash، الذي لا يزال مدعومًا. ابدأ بـ شرح واجهة برمجة التطبيقات، وأرسل طلبك الأول من Apidog مع تأكيد عدد الرموز المرفق، ودع الرقم، وليس منشور الإطلاق، يقرر مستوى التفكير لكل مسار.
