Gemini 3.8 Flash: مستويات التفكير - منخفض ومتوسط ومرتفع، ولماذا اختفى المستوى الأدنى

شرح مستويات التفكير في جيميني 3.8 فلاش: ما تفعله المستويات المنخفضة والمتوسطة والعالية، لماذا الأخطاء الحالية تكاد تكون معدومة، أرقام التكلفة والكمون لكل مستوى، وكيفية إعداد كل منها.

Ashley Goolam

Ashley Goolam

3 سبتمبر 2026

Gemini 3.8 Flash: مستويات التفكير - منخفض ومتوسط ومرتفع، ولماذا اختفى المستوى الأدنى

Apidog للمؤسسات

النشر على الخوادم المحلية

SSO و RBAC

متوافق مع SOC 2

استكشف Apidog للمؤسسات

يأتي Gemini 3.8 Flash بثلاثة مستويات للتفكير: منخفض، متوسط، وعالي. يتحكم الإعداد في مقدار الاستدلال الداخلي الذي يقوم به النموذج قبل الإجابة، وفي هذا النموذج، يؤثر في ثلاثة مقاييس في آن واحد: زمن الاستجابة، وعدد الرموز المميزة الناتجة، وفاتورتك. صممت Google نموذج 3.8 Flash لـ "العمل بجدية أكبر" في المهام المعقدة، لذا فإن المستوى الذي تختاره يهم أكثر مما كان عليه الحال في 3.7 Flash. إذا كنت جديدًا على النموذج، فإن نظرة عامة على Gemini 3.8 Flash تغطي الإطلاق. هذا الدليل مخصص فقط لمقبض التحكم.

هناك تفصيلان يربكان الفرق في الساعة الأولى. المستوى الافتراضي في 3.8 Flash هو متوسط، وليس عالي (نموذج Gemini 3 Pro الافتراضي هو عالي، وهذا هو مصدر الارتباك). ولم يعد minimal، الذي لا تزال التكوينات المكتوبة لـ Gemini 3.7 Flash ترسله، مقبولاً: يفشل الطلب في التحقق من الصحة قبل إنشاء رمز مميز واحد. توثق Google كليهما في صفحة ما الجديد في Gemini 3.8 Flash.

أدناه: ما يفعله كل مستوى، تكلفته لكل مهمة، كيفية ضبطه في كلا شكلي واجهة برمجة التطبيقات، استراتيجية لكل مسار، واختبار قابل للتكرار يوضح الفرق في الرموز المميزة وزمن الاستجابة قبل النشر.

مستويات التفكير في لمحة

المستوى إرشادات Google التكلفة لكل مهمة (AA) الوقت لكل مهمة (AA) استخدمه عندما
منخفض يقلل من زمن الاستجابة والتكلفة؛ اتباع التعليمات البسيطة، الدردشة، المسارات ذات الإنتاجية العالية 0.24 دولار 0.8 دقيقة يكون زمن الاستجابة للمستخدم مهمًا؛ البحث في النصوص؛ التصنيف
متوسط (افتراضي) الافتراضي للتعليمات البرمجية المعقدة والعمل الوكالي 0.41 دولار لم ينشر في النص معظم المسارات؛ أسئلة وأجوبة الفيديو العامة
عالي أقصى عمق للاستدلال للمشكلات متعددة الخطوات الأكثر صعوبة 0.58 دولار 2.5 دقيقة أسئلة وأجوبة بصرية مكثفة؛ فيديو مدته 60 دقيقة فأكثر؛ خطوات التخطيط التي تتحكم في كل ما يليها
minimal غير مدعوم في 3.8 Flash غير متوفر غير متوفر أبدًا؛ قم بتعيينه إلى منخفض

أعمدة التكلفة والوقت هي متوسطات Artificial Analysis من تشغيل مؤشر الذكاء الخاص بهم على كل مستوى، بالأسعار التمهيدية للرموز المميزة من Google. هذه أرقام مستقلة، وليست من Google، وهي تقيس عبء عمل مرجعيًا، وليس مطالباتك. استخدمها للنسب، ثم قم بقياس مساراتك الخاصة.

ما يفعله كل مستوى

يمكن أن تتضمن كل استجابة من 3.8 Flash رموز تفكير مميزة: وهي الاستدلال الذي يولده النموذج قبل الإجابة المرئية. تدفع مقابلها كرموز مميزة ناتجة (3.75 دولار لكل مليون بالسعر التمهيدي حتى 31-12-2026، و7.50 دولار اعتبارًا من 01-01-2027)، وتقوم واجهة برمجة التطبيقات بالإبلاغ عنها بشكل منفصل كـ usageMetadata.thoughtsTokenCount. يخبر مستوى التفكير النموذج بمقدار الاستدلال الذي يجب القيام به.

ما يجعل هذا مختلفًا في 3.8 Flash هو السلوك الافتراضي الجديد للنموذج. في المهام المعقدة، فإنه "ينفذ خطوات استدلال إضافية، ويستدعي الأدوات بشكل متكرر" و"يتحقق من عمله على طول الطريق". تقول Google بوضوح إنه "يمكنه استخدام المزيد من الرموز المميزة في المهام الأطول والأكثر تعقيدًا، حسب التصميم" وأن "النموذج قد يستخدم المزيد من الرموز المميزة لزيادة الأداء إلى أقصى حد، خاصة عند مستويات الجهد الأعلى". مستوى التفكير هو المقيد لهذا السلوك. تقليله هو الاقتراح الأول من Google عندما يرتفع استخدام الرموز المميزة؛ والثاني هو البقاء على 3.7 Flash، والذي لا يزال مدعومًا بالكامل.

قيد واحد يجب استيعابه: thinking_level هو تعداد (enum)، وليس ميزانية. لقد اختفى العدد الصحيح thinking_budget من النماذج السابقة في Gemini 3، لذا لا يمكنك طلب "ما يصل إلى 2,000 رمز تفكير مميز". تختار مستوى ثم تتحقق مما يكلفه في مطالباتك، وهذا هو سبب أهمية الاختبار في نهاية هذا الدليل.

الافتراضي هو متوسط، وليس عالي

حذف الحقل ويتم تشغيل 3.8 Flash على متوسط. وهذا يوقع مجموعتين.

تتوقع الفرق التي قامت بعمل نماذج أولية على Gemini 3 Pro مستوى عالي افتراضيًا وتحصل على إجابات متوسطة العمق دون ملاحظة ذلك. الفرق التي أزالت thinking_budget أثناء ترقية 3.7 Flash ولم تستبدله بمستوى تنتهي بها المطاف إلى استخدام متوسط في كل مكان، بما في ذلك مسارات الدردشة التي يجب أن تكون على منخفض.

الحل لكلا المشكلتين هو نفسه: اضبط thinking_level بشكل صريح في كل طلب، لكل مسار، في ملف الإعدادات، وليس في التعليمات البرمجية. الإعدادات الافتراضية هي من صلاحية Google للتغيير؛ يجب ألا تتغير ميزانية التكلفة الخاصة بك عند حدوث ذلك.

لماذا اختفى `minimal` وكيفية إصلاح الخطأ

عمل minimal على Gemini 3.7 Flash. في 3.8 Flash، لم يعد ضمن المجموعة المدعومة، وتدرج صفحة النموذج مستويات التفكير على أنها منخفض، ومتوسط، وعالي فقط. أرسله عبر REST ويتم رفض الطلب قبل تشغيل النموذج برسالة 400 INVALID_ARGUMENT ونص "مستوى التفكير MINIMAL غير مدعوم لهذا النموذج. يرجى إعادة المحاولة بمستوى تفكير آخر." (تم التحقق من ذلك بمكالمة حية في 3 سبتمبر 2026). تقوم حزم تطوير البرامج (SDKs) بتغليف ذلك في فئة استثناء خاصة بها، لذا قم بالمطابقة بناءً على حالة 400 أو رمز INVALID_ARGUMENT، وليس على سلسلة الرسالة.

{
  "model": "gemini-3.8-flash",
  "input": "Classify this ticket as billing, bug, or feature.",
  "generation_config": { "thinking_level": "minimal" }
}

بعد:

{
  "model": "gemini-3.8-flash",
  "input": "Classify this ticket as billing, bug, or feature.",
  "generation_config": { "thinking_level": "low" }
}

إرشادات Google للترحيل هي تعيين مباشر: minimal يصبح منخفض. هناك إغراءان يجب تجنبهما أثناء وجودك في هذا الإعداد. لا تسعَ إلى thinking_budget للحصول على حد أدنى أصغر؛ فهو غير مدعوم في نماذج Gemini 3. ولا تقلل temperature لـ "تهدئة النموذج"؛ تقول Google بضرورة تركه على القيمة الافتراضية 1.0 في جميع نماذج Gemini 3 لأن تقليله قد يسبب تكرارًا أو إخراجًا متدهورًا. القائمة المرجعية الكاملة، بما في ذلك توقيعات التفكير ومتطلب call_id على استجابات الوظائف، موجودة في دليل الترحيل من 3.7 إلى 3.8 Flash.

نظرًا لأن الخطأ يحدث عند وقت التحقق من الصحة، فإن طلب اختبار مجدول على كل مستوى يلتقط أي إعداد يعود إلى minimal مجانًا.

ما يكلفه كل مستوى لكل مهمة

لا تتغير تسعيرة الرموز المميزة حسب المستوى. تدرج صفحة تسعير Google كل مكالمة 3.8 Flash بسعر 0.75 دولار للمدخلات و 3.75 دولار للمخرجات لكل مليون رمز مميز بالسعر التمهيدي، ليتضاعف إلى 1.50 دولار و 7.50 دولار في 01-01-2027. الفرق بين المستويات هو مجرد عدد الرموز المميزة، وهذا ما قاسه Artificial Analysis.

النموذج والمستوى التكلفة لكل مهمة الوقت لكل مهمة
Gemini 3.8 Flash منخفض 0.24 دولار 0.8 دقيقة
Gemini 3.8 Flash متوسط 0.41 دولار لم ينشر في النص
Gemini 3.8 Flash عالي 0.58 دولار 2.5 دقيقة
Gemini 3.7 Flash عالي 0.40 دولار 2.2 دقيقة

المصدر: Artificial Analysis، تشغيل مؤشر الذكاء بالأسعار التمهيدية. تظهر ثلاث نسب من الجدول.

يعمل `منخفض` بحوالي 41% من تكلفة `عالي` وحوالي ثلث وقته الفعلي. هذا هو أكبر عامل تحكم فردي لديك في هذا النموذج.

يكلف `متوسط` على 3.8 Flash تقريبًا ما كان يكلفه `عالي` على 3.7 Flash (0.41 دولار مقابل 0.40 دولار). إذا كنت راضيًا عن 3.7 Flash على `عالي`، فإن 3.8 Flash على `متوسط` هو خط الميزانية المماثل.

يكلف `عالي` على 3.8 Flash أكثر بنسبة 45% لكل مهمة من `عالي` على 3.7 Flash، بأسعار متطابقة لكل رمز مميز، لأن النموذج يصدر حوالي 30% رموز مميزة ناتجة إضافية (48 ألفًا في المتوسط لكل مهمة فهرسة). هذا هو تصميم "العمل بجدية أكبر" الذي يظهر في الفاتورة. يعتمد ما إذا كانت الرموز المميزة الإضافية تستحق تكلفتها على عبء العمل؛ مقارنة 3.8 Flash مقابل 3.7 Flash توضح أين تحققت مكاسب الجودة.

تحذير واحد بشأن الجودة: درجة مؤشر الذكاء لـ AA البالغة 59 لـ 3.8 Flash هي تشغيل `عالي`. لم ينشروا درجات المؤشر للمستويات `متوسط` أو `منخفض` في النص، لذا لا تفترض أن منحنى الجودة خطي مع التكلفة. اختبر تقييماتك الخاصة على كل مستوى قبل نقل مسار إلى مستوى أدنى. للمثال العملي لـ 1,000 مهمة يوميًا على كل مستوى ونقطة تحول الأسعار في 31 ديسمبر، انظر تسعير Gemini 3.8 Flash.

ضبط thinking_level في Interactions API

Interactions API هي الواجهة الأساسية من Google لـ Gemini 3.x. يقع المستوى في generation_config كسلسلة نصية بتنسيق snake_case:

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' \
  -d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'

في بايثون:

interaction = client.interactions.create(
    model="gemini-3.8-flash",
    input="Explain HTTP caching in 3 sentences.",
    generation_config={"thinking_level": "low"},
)
print(interaction.output_text)

إنه حقل على مستوى الطلب، لذا قم بتعيينه في كل استدعاء، بما في ذلك الأدوار المتتالية التي تمرر previous_interaction_id. تعود الاستجابة كقائمة بخطوات التنفيذ (أفكار، استدعاءات الأدوات) تنتهي بـ model_output، وتكشف حزمة تطوير البرامج (SDK) النص النهائي كـ output_text. للمرور الكامل بالمكالمة الأولى، بما في ذلك حالة الأدوار المتعددة والتدفق، انظر كيفية استخدام Gemini 3.8 Flash API.

ضبطه في generateContent القديمة

لا يزال معظم كود Gemini الحالي يستدعي generateContent. تسميها Google قديمة ولكنها تقول إنها لا تزال مدعومة بالكامل دون تاريخ إيقاف، لذا لا داعي للعجلة. الحقل متداخل مستوى أعمق ومكتوب بصيغة camelCased:

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST \
  -d '{"contents":[{"parts":[{"text":"Explain HTTP caching in 3 sentences."}]}],
       "generationConfig":{"thinkingConfig":{"thinkingLevel":"low","includeThoughts":true}}}'

في بايثون:

from google.genai import types

response = client.models.generate_content(
    model="gemini-3.8-flash",
    contents="Explain HTTP caching in 3 sentences.",
    config=types.GenerateContentConfig(
        thinking_config=types.ThinkingConfig(thinking_level="low")
    ),
)
print(response.usage_metadata.thoughts_token_count)

includeThoughts: true يضيف ملخصات الأفكار إلى الاستجابة كأجزاء معلمة بـ thought: true: مفيد أثناء معايرة المستوى، وضوضاء بمجرد الانتهاء. الرقم الذي تهتم به هو usageMetadata.thoughtsTokenCount، وهو العدد الدقيق الذي يتم فوترته كإخراج والحقل الذي يجب أن تراقبه اختباراتك.

استراتيجية لكل مسار

تعامل مع المستوى كقرار توجيه، وليس إعدادًا عامًا. تقسيم عملي:

إذا كان منخفض على 3.8 Flash لا يزال أكثر من احتياج المسار، فإن خط Flash-Lite موجود لتلك المهمة؛ دليل Gemini 3.1 Flash-Lite السابق يغطي المقايضة، وGemini 3.5 Flash-Lite هو الإصدار الحالي بسعر 0.30 دولار للمدخلات و 2.50 دولار للمخرجات.

حافظ على المستوى في إعدادات كل مسار واحتفظ بـ gemini-3.7-flash خلف علامة. إذا ارتفع عدد الرموز المميزة لمسار بعد الترقية، يمكنك خفض المستوى أو تغيير النموذج دون نشر جديد.

اختبر المستويات الثلاثة جنبًا إلى جنب في Apidog

قراءة جدول AA يخبرك بالنسب. مطالباتك فقط تخبرك بالأرقام. إليك سيناريو اختبار في Apidog يرسل مطالبة ذهبية واحدة على كل مستوى ويتحقق مما عاد. يعمل مع أي شكل من أشكال واجهة برمجة التطبيقات؛ يتم عرض نقطة النهاية القديمة لأن usageMetadata هو حقل على مستوى أعلى هناك.

  1. تخزين المفتاح كمتغير بيئة. أنشئ GEMINI_API_KEY في بيئة Apidog وارجع إليه كـ {{GEMINI_API_KEY}} في رأس x-goog-api-key. أضف متغيرًا ثانيًا، THINKING_LEVEL، بحيث يخدم طلب واحد محفوظ جميع الخطوات الثلاث.
  2. حفظ طلب واحد. أرسل طلب POST إلى /v1beta/models/gemini-3.8-flash:generateContent مع مطالبتك الذهبية و "thinkingConfig": {"thinkingLevel": "{{THINKING_LEVEL}}"}.
  3. بناء سيناريو اختبار من ثلاث خطوات. استورد نفس الطلب ثلاث مرات وتجاوز قيمة THINKING_LEVEL إلى منخفض، متوسط، وعالي في كل خطوة.
  4. التحقق من الحقول المتغيرة. في كل خطوة: الحالة 200 و usageMetadata.thoughtsTokenCount موجود. في خطوة منخفض، تحقق من أن thoughtsTokenCount ووقت الاستجابة يظلان تحت السقف الذي يمكن أن يتحمله هذا المسار (اضبط خط الأساس بعد تشغيلك الأول). يمكن لبرنامج نصي ما بعد المعالجة تخزين عدد كل خطوة في متغير بحيث يمكن لخطوة عالي التأكد من أنها استدلت على الأقل بنفس قدر `منخفض`. إذا انعكس هذا الترتيب في أي وقت، فقد تغير النموذج أو الافتراضي لديك.
  5. أضف خطوة حماية. أرسل thinkingLevel: "minimal" وتأكد من أن الاستجابة ليست 200. عندما تقوم بتبديل معرفات النموذج لاحقًا، تخبرك هذه الخطوة ما إذا كان النموذج الجديد لا يزال يرفضها.
  6. جدولته. قم بتشغيل السيناريو يوميًا حتى يظهر تراجع في الإعدادات أو تغيير سلوك صامت كتشغيل أحمر، وليس فاتورة مفاجئة. الآليات موجودة في كيفية جدولة اختبارات API في Apidog.

بالنسبة للاستجابات المتدفقة، ينطبق نفس السيناريو مع عرض SSE؛ يغطي كيفية اختبار واجهات برمجة تطبيقات LLM التي تتدفق عبر SSE الإعداد. قم بتنزيل Apidog للمتابعة؛ الخطة المجانية تغطي هذا السيناريو بالكامل.

الأسئلة الشائعة

هل يغير مستوى التفكير سعر الرمز المميز؟

لا. سعر المدخلات هو 0.75 دولار والمخرجات 3.75 دولار لكل مليون رمز مميز على 3.8 Flash بالسعر التمهيدي بغض النظر عن المستوى. يغير المستوى عدد الرموز المميزة الناتجة التي يولدها النموذج كتفكير، ويتم تحصيل رسومها بسعر المخرجات. يغطي تفصيل التسعير التخزين المؤقت، والدفعات، وزيادة الأول من يناير.

هل يمكنني تعيين ميزانية دقيقة لرموز التفكير المميزة بدلاً من ذلك؟

ليس على نماذج Gemini 3. تم استبدال thinking_budget بالتعداد thinking_level، ويقبل 3.8 Flash فقط منخفض ومتوسط وعالي. إذا كنت بحاجة إلى سقف، فافرضه في الاختبارات والتنبيهات بدلاً من الطلب.

أي مستوى يستخدمه Artificial Analysis في درجة 59؟

عالي. أجرى AA مؤشر الذكاء على مستوى عالي للحصول على النتيجة الرئيسية ونشر التكلفة والوقت على مستوى منخفض ومتوسط أيضًا، ولكن لم ينشر درجات المؤشر لتلك المستويات. عامل المستويات الأدنى على أنها غير مختبرة على هذا المعيار حتى تقوم بتشغيل تقييماتك الخاصة.

هل يجب أن أقلل درجة الحرارة لتقليل التفكير؟

لا. إرشادات Google لجميع نماذج Gemini 3 هي الحفاظ على temperature عند القيمة الافتراضية 1.0. تقليله قد يسبب تكرارًا أو إخراجًا متدهورًا. استخدم thinking_level للتحكم في عمق الاستدلال.

ماذا لو كان حتى مستوى "منخفض" بطيئًا جدًا أو مكلفًا جدًا؟

ابق على Gemini 3.7 Flash، الذي تقول Google إنه لا يزال مدعومًا بالكامل بدون تاريخ إيقاف، أو انقل المسار إلى نموذج Flash-Lite. مقارنة 3.8 Flash مقابل 3.7 Flash توضح أين تشتري الرموز المميزة الإضافية جودة قابلة للقياس وأين لا تفعل ذلك.

اختر المستوى لكل مسار، ثم قسّه

ثلاثة مستويات، تعداد واحد، ونموذج يستدل أكثر من سابقه افتراضيًا. اضبط thinking_level بشكل صريح على كل مسار، وقم بتعيين أي minimal متبقي إلى منخفض، وراقب usageMetadata.thoughtsTokenCount لتحديد تأثير كل مستوى. تمنحك أرقام AA لكل مهمة (0.24 دولار، 0.41 دولار، 0.58 دولار) شكل المنحنى؛ ويمنحك سيناريو من ثلاث خطوات في Apidog أرقامك الخاصة قبل أن يجعل تغيير الأسعار في 31 ديسمبر هذه الأرقام ذات أهمية مضاعفة.

ممارسة تصميم API في Apidog

اكتشف طريقة أسهل لبناء واستخدام واجهات برمجة التطبيقات