أسعار Gemini 3.8 Flash: عروض الإطلاق، توكنات التفكير، والتكلفة الفعلية للمهمة

أسعار Gemini 3.8 Flash: أسعار تمهيدية 0.75 دولار أمريكي / 3.75 دولار أمريكي تتضاعف في 1 يناير 2027، رموز التفكير تُحاسب كإخراج، التخزين المؤقت، المعالجة الدفعية، ولماذا ارتفعت تكلفة المهمة الواحدة إلى 0.58 دولار أمريكي.

Ashley Goolam

Ashley Goolam

3 سبتمبر 2026

أسعار Gemini 3.8 Flash: عروض الإطلاق، توكنات التفكير، والتكلفة الفعلية للمهمة

Apidog للمؤسسات

النشر على الخوادم المحلية

SSO و RBAC

متوافق مع SOC 2

استكشف Apidog للمؤسسات

تبلغ تكلفة Gemini 3.8 Flash 0.75 دولار لكل مليون رمز إدخال و 3.75 دولار لكل مليون رمز إخراج، وهو نفس السعر الافتتاحي الذي حددته Google لـ 3.7 Flash. يستمر هذا السعر حتى 31 ديسمبر 2026. في 1 يناير 2027، يتضاعف السعر ليصبح 1.50 دولار و 7.50 دولار، وينطبق نفس التضاعف على 3.6 Flash و 3.7 Flash في نفس اليوم. لم يتغير أي شيء في سعر الرمز الواحد مع هذا الإصدار.

ما تغير هو عدد الرموز التي يستهلكها النموذج. تقول Google إن 3.8 Flash "يعمل بجدية أكبر": فهو يتخذ المزيد من خطوات التفكير، ويستدعي الأدوات بشكل متكرر، و"يمكنه استخدام المزيد من الرموز في المهام الأطول والأكثر تعقيدًا، حسب التصميم". قامت Artificial Analysis بقياس التأثير بشكل مستقل: كلف تشغيل مؤشر الذكاء الخاص بها 0.58 دولار لكل مهمة على 3.8 Flash بمستوى تفكير عالٍ مقابل 0.40 دولار على 3.7 Flash، مع حوالي 30% المزيد من رموز الإخراج لكل مهمة. نفس السعر المعلن، فاتورة أعلى.

يرشدك هذا الدليل عبر كل سطر في صفحة تسعير Gemini API الرسمية، ويعرض مثالاً لـ 1000 مهمة يوميًا عند كل مستوى تفكير، ويقارن السعر مع Flash-Lite و Claude Sonnet 5 و GPT-5.6 Luna. للحصول على نظرة عامة على النموذج أولاً، ابدأ بـ ما هو Gemini 3.8 Flash.

أسعار Gemini 3.8 Flash بنظرة سريعة

جميع الأسعار لكل مليون رمز على المستوى المدفوع.

السعر مقدمة (حتى 31 ديسمبر 2026) قياسي (اعتبارًا من 1 يناير 2027)
الإدخال (نص، صورة، فيديو، صوت، PDF) $0.75 $1.50
الإخراج (يشمل رموز التفكير) $3.75 $7.50
قراءة ذاكرة التخزين المؤقت للسياق $0.075 $0.15
تخزين ذاكرة التخزين المؤقت (لكل مليون رمز في الساعة) $0.50 $1.00
إدخال Batch API (خصم 50%) $0.375 $0.75
إخراج Batch API (خصم 50%) $1.875 $3.75
تأريض بحث Google 5000 طلب مجاني/شهريًا مشترك عبر Gemini 3.x، ثم 14 دولار لكل 1000 نفس الشيء
المستوى المجاني 0 دولار، محدود السعر، البيانات المستخدمة لتحسين منتجات Google نفس الشيء

ثلاثة تفاصيل تهم أكثر من الأرقام الرئيسية. تغطية تسعير الإخراج لرموز التفكير، لذا تكلف عمليات التفكير الداخلية 3.75 دولارًا، وليس 0.75 دولارًا. السعر الافتتاحي له تاريخ انتهاء محدد. وتحمل صفوف 3.7 Flash و 3.6 Flash نفس مضاعفة 1 يناير، لذا فإن إصدار Flash الأقدم لا يحميك من الزيادة. تغطي تفاصيل تسعير 3.7 Flash نفس الأسعار على نموذج يستهلك رموزًا أقل لكل مهمة.

رموز التفكير هي رموز إخراج

يقوم Gemini 3.8 Flash بالتفكير قبل الإجابة، ويتم احتساب كل رمز من هذا التفكير كإخراج. يقوم الـ API بالإبلاغ عن العدد كـ usageMetadata.thoughtsTokenCount في استجابة generateContent، بشكل منفصل عن candidatesTokenCount (الإجابة المرئية) و promptTokenCount (إدخالك). يتم احتساب تكلفة كلا مجموعتي الإخراج بنفس السعر 3.75 دولار.

يمكنك التحكم في الكمية باستخدام thinking_level: منخفض، متوسط، أو مرتفع. في 3.8 Flash، الإعداد الافتراضي هو متوسط، وليس مرتفع كما هو الحال في Gemini 3 Pro. تمت إزالة minimal ويعيد خطأ في التحقق، لذا فإن أي تهيئة موروثة من النماذج السابقة تحتاج إلى تعيين هذه القيمة إلى low. تصف وثائق التفكير من Google المستويات على أنها جهد نسبي، وليست ميزانية رمزية، لذلك لا يمكنك تحديد سقف لرموز التفكير مباشرة بالطريقة التي كان يسمح بها thinking_budget القديم. ما تفعله كل مستوى بالنسبة للكمون والتكلفة موجود في دليل مستويات تفكير 3.8 Flash.

توضيح سريع بأحجام وهمية ولكنها واقعية. لنفترض أن طلبًا يرسل 10,000 رمز إدخال ويستقبل 2,000 رمز إخراج مرئي بالإضافة إلى 6,000 رمز تفكير. بالأسعار التمهيدية:

يشكل التفكير 75% من تكلفة الإخراج و 60% من إجمالي الطلب. اعتبارًا من 1 يناير، ستكلف نفس الطلب 0.015 دولار + 0.06 دولار = 0.075 دولار. عبارة "نفس سعر 3.7" صحيحة وغير كاملة: فقد ظل السعر كما هو، لكن عدد الرموز تغير.

لماذا ارتفعت التكلفة لكل مهمة بينما لم يرتفع السعر

توضح مقالة إطلاق Google بوضوح المقايضة: في المهام المعقدة، يقوم النموذج "بتنفيذ خطوات تفكير إضافية، ويستدعي الأدوات بشكل متكرر"، متحققًا من عمله أثناء التنفيذ. المزيد من الخطوات يعني المزيد من رموز التفكير، وفي حلقات الوكيل، المزيد من دورات استدعاء الأدوات. نصيحة Google للتخفيف: خفض thinking_level، أو البقاء على 3.7 Flash.

Artificial Analysis قدمت أرقامًا حول هذا الأمر. يشغل مؤشر الذكاء الخاص بها تسعة تقييمات؛ سجل 3.8 Flash على مستوى عالٍ 59 نقطة مقابل 56 نقطة لـ 3.7 Flash على مستوى عالٍ، مستخدمًا حوالي 48,000 رمز إخراج لكل مهمة في المتوسط، بزيادة 30% عن 3.7 Flash. تكلفة تشغيل المؤشر لكل مهمة:

التهيئة التكلفة لكل مهمة (AA، أسعار مقدمة) الوقت لكل مهمة
Gemini 3.8 Flash، مرتفع $0.58 2.5 دقيقة
Gemini 3.8 Flash، متوسط $0.41 لم يُنشر
Gemini 3.8 Flash، منخفض $0.24 0.8 دقيقة
Gemini 3.7 Flash، مرتفع $0.40 2.2 دقيقة

اقرأ الجدول بطريقتين. مقارنة بسابقه، يكلف 3.8 Flash على مستوى مرتفع 45% أكثر لكل مهمة (0.58 دولار / 0.40 دولار = 1.45) لتحقيق زيادة بثلاث نقاط في المؤشر. مقارنة بنفسه، فإن الانتقال من مستوى عالٍ إلى متوسط يقلل التكلفة لكل مهمة بنسبة 29% (0.41 دولار / 0.58 دولار = 0.71)، والمستوى المنخفض يقللها بنسبة 59% (0.24 دولار / 0.58 دولار = 0.41). يأتي مستوى متوسط في 3.8 Flash بفارق سنت واحد عن مستوى عالٍ في 3.7 Flash، وهو نقطة مرجعية مفيدة عند تحديد ما إذا كان يجب الترقية على الإطلاق. توضح مقارنة 3.8 Flash مقابل 3.7 Flash هذا القرار حسب حجم العمل.

تذكر Artificial Analysis أيضًا سعرًا مختلطًا قدره 0.58 دولار لكل مليون رمز بنسبة إدخال إلى إخراج 3:1. أن يتطابق هذا مع التكلفة عالية المستوى لكل مهمة هو صدفة؛ أحدهما هو سعر الرمز الواحد، والآخر يعتمد على عدد الرموز التي يختار النموذج إنفاقها.

استفد من السعر الافتتاحي قبل 31 ديسمبر

عبارة "استفد من السعر" تحتاج إلى معنى دقيق، لأن السعر الافتتاحي ليس عقدًا. تحاسب Google الاستخدام بالسعر الساري وقت استهلاك الرموز، لذا لا يمكنك الدفع المسبق لاستخدام 2027 بأسعار 2026، والانتقال إلى 3.7 أو 3.6 Flash لا يساعد. ما يمكنك فعله هو نقل الأعمال التقديرية إلى هذه الفترة:

إذا كان السعر هو العامل الحاسم بين المزودين، فإن ملخصنا لأرخص مزودي LLM API يعرض المجال بالكامل؛ وتغطي مقارنة Fable 5.1 و GPT-5.6 Sol المستويات المميزة.

كيف يقارن بـ Flash-Lite و Sonnet 5 و GPT-5.6 Luna

أسعار الرمز الواحد، لكل مليون رمز:

النموذج الإدخال الإخراج ملاحظات
Gemini 3.8 Flash (مقدمة) $0.75 $3.75 يتم احتساب التفكير كإخراج؛ قراءة ذاكرة التخزين المؤقت 0.075 دولار
Gemini 3.8 Flash (اعتبارًا من 1 يناير) $1.50 $7.50 قراءة ذاكرة التخزين المؤقت 0.15 دولار
Gemini 3.5 Flash-Lite $0.30 $2.50 حوالي 350 رمز/ثانية
Claude Sonnet 5 $2 $10 دائم؛ تم إلغاء زيادة 1 سبتمبر
GPT-5.6 Luna $1 $6

بالأسعار التمهيدية، إدخال 3.8 Flash هو 2.5 ضعف إدخال Flash-Lite، وإخراجه 1.5 ضعف. مقارنة بـ Sonnet 5، يعتبر 3.8 Flash أرخص بحوالي 2.7 مرة في كل من الإدخال (2 دولار / 0.75 دولار) والإخراج (10 دولار / 3.75 دولار). مقارنة بـ Luna، هو أرخص أيضًا: 0.75 دولار مقابل 1 دولار للإدخال، 3.75 دولار مقابل 6 دولارات للإخراج.

تنقلب الصورة في 1 يناير. بسعر 1.50 دولار و 7.50 دولار، يصبح 3.8 Flash أغلى من Luna من كلا الجانبين، ويضيق الفارق مع Sonnet 5 إلى حوالي 1.3 مرة (2 دولار / 1.50 دولار و 10 دولار / 7.50 دولار). يبقى Flash-Lite أرخص طوال الوقت. إذا كان السعر الافتتاحي هو سبب اختيارك لـ 3.8 Flash، فضع إعادة التقييم في يناير في جدولك الآن.

مقارنة الرمز الواحد هي نصف الصورة فقط. النموذج الذي يستهلك رموزًا أقل لكل إجابة يمكن أن يكلف أقل لكل مهمة بسعر أعلى، والطريقة الوحيدة لمعرفة ذلك هي تشغيل نفس مجموعة المهام عبر كل مرشح وقراءة عدد الاستخدامات. يوضح دليل API لـ 3.8 Flash كيفية قراءة usageMetadata من كل من Interactions API و generateContent القديم.

اكتشف تراجعات التكلفة باستخدام تأكيدات رموز Apidog

نمط الفشل في 3.8 Flash ليس إجابة خاطئة. بل هي إجابة صحيحة استخدمت بهدوء 40% المزيد من الرموز بعد تعديل في المطالبة أو تغيير في مستوى التفكير، ولا يلاحظ أحد ذلك حتى تأتي الفاتورة. يصلح Apidog ذلك بمعاملة عدد الرموز كحقل يمكن التأكيد عليه، مثل رمز الحالة.

  1. قم بتخزين المفتاح كمتغير بيئة. أنشئ GEMINI_API_KEY في بيئة Apidog وارجع إليه كـ {{GEMINI_API_KEY}} في رأس x-goog-api-key، بحيث لا يكون المفتاح أبدًا في طلب محفوظ.
  2. أرسل مطالبة ذهبية. احفظ طلب POST إلى https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent مع مطالبة تمثيلية و thinkingConfig.thinkingLevel صريح، واحد لكل مسار إنتاجي.
  3. تأكد من حقول الاستخدام. أضف نصًا برمجيًا للمعالجة اللاحقة يقرأ usageMetadata ويفشل الاختبار إذا تجاوزت الرموز سقفًا محددًا من خط الأساس الخاص بك:
const usage = pm.response.json().usageMetadata;
pm.test("thinking tokens within budget", () => {
  pm.expect(usage.thoughtsTokenCount).to.be.below(8000);
});
pm.test("visible output within budget", () => {
  pm.expect(usage.candidatesTokenCount).to.be.below(2500);
});
pm.test("request cost within budget", () => {
  const cost = usage.promptTokenCount * 0.75 / 1e6
    + (usage.thoughtsTokenCount + usage.candidatesTokenCount) * 3.75 / 1e6;
  pm.expect(cost).to.be.below(0.05);
});
  1. جدولها. ضع الطلبات في سيناريو اختبار وقم بتشغيلها وفقًا لجدول زمني، بحيث يظهر أي قفزة في استخدام الرموز كتشغيل فاشل في نفس اليوم؛ يغطي دليلنا حول جدولة اختبارات API في Apidog الإعداد. حدّث ثوابت السعرين في 1 يناير وسيستمر تأكيد التكلفة في تتبع الفاتورة.

نفس السيناريو يعمل أيضًا كمقارنة بين المزودين: وجه نسخة إلى Flash-Lite أو Sonnet 5 أو Luna وقارن حقول الاستخدام جنبًا إلى جنب. قم بتنزيل Apidog لبناء السيناريو الأول؛ تغطي الخطة المجانية سير العمل هذا.

الأسئلة الشائعة

هل يكلف Gemini 3.8 Flash أكثر من 3.7 Flash؟ لكل رمز، لا. كلاهما 0.75 دولار للإدخال و 3.75 دولار للإخراج حتى 31 ديسمبر، ثم 1.50 دولار و 7.50 دولار. لكل مهمة، نعم: قامت Artificial Analysis بقياس 0.58 دولار لكل مهمة فهرسة على 3.8 Flash بمستوى عالٍ مقابل 0.40 دولار على 3.7 Flash، لأن 3.8 Flash يولد حوالي 30% المزيد من رموز الإخراج.

هل يتم احتساب رموز التفكير بشكل منفصل؟ لا. يتم احتسابها كرموز إخراج بسعر 3.75 دولار لكل مليون (مقدمة) وتظهر في usageMetadata.thoughtsTokenCount. يمكنك التحكم فيها بشكل غير مباشر من خلال thinking_level؛ لا توجد ميزانية رموز ثابتة في 3.8 Flash، و minimal يعيد خطأ.

هل يوجد مستوى مجاني لـ Gemini 3.8 Flash؟ نعم. المستوى المجاني في AI Studio لا يفرض رسومًا على الإدخال أو الإخراج، مع حدود معدل معروضة في AI Studio، وتستخدم Google بيانات المستوى المجاني لتحسين منتجاتها. يقدم تطبيق Gemini للمستهلك 3.8 Flash فقط لمشتركي AI Pro و Ultra. التفاصيل موجودة في دليل الاستخدام المجاني.

ماذا يحدث لتكاليفي في 1 يناير 2027؟ تتضاعف جميع أسعار الإدخال والإخراج وقراءة ذاكرة التخزين المؤقت وتخزين ذاكرة التخزين المؤقت والدفعة. إذا بقي استخدام الرموز لكل مهمة كما هو، فستتضاعف فاتورتك أيضًا. تتضاعف صفوف 3.6 و 3.7 Flash في نفس التاريخ.

ما هو مستوى التفكير الذي يحافظ على انخفاض التكاليف؟ ابدأ من انتشار Artificial Analysis: منخفض 0.24 دولار، متوسط 0.41 دولار، مرتفع 0.58 دولار لكل مهمة فهرسة. قم بتشغيل تقييماتك الخاصة عند كل مستوى، واحتفظ بأقل مستوى ينجح، وتأكد من عدد الرموز حتى لا يتغير الإعداد.

ما يجب فعله هذا الأسبوع

يتم تسعير Gemini 3.8 Flash مثل 3.7 Flash ويستهلك الرموز كنموذج أكبر. تعامل مع مستوى التفكير كإعداد تكلفة وقم بتعيينه لكل مسار. انقل الأعمال المناسبة للدفعة إلى الفترة التمهيدية قبل 31 ديسمبر. حدد خط الأساس لاستخدامك للرموز الآن وتأكد منه، بحيث تكون مضاعفة يناير تغييرًا أخذته في الاعتبار.

ممارسة تصميم API في Apidog

اكتشف طريقة أسهل لبناء واستخدام واجهات برمجة التطبيقات