Gemini 3.8 Flash متاح اليوم: نموذج مستقر مع طبقة مجانية، بسعر 0.75 دولار للمدخلات و 3.75 دولار للمخرجات لكل مليون رمز حتى 31-12-2026، ثم 1.50 دولار و 7.50 دولار، بحد أقصى للمخرجات 64 ألف رمز. أما Gemini 4 Argon فليس كذلك. تحدد تدوينة إطلاق جوجل سعره بـ 2 دولار و 10 دولارات خلال فترة تقديمية غير محددة المدة، ثم 4 دولارات و 20 دولارًا. تقول جوجل إن حد الإخراج الخاص به هو مليون رمز، وهو متاح اليوم فقط للمدافعين عن برنامج Fairwind. إذا كنت بحاجة إلى إطلاق منتج هذا الربع، فاعتمد على Flash واحتفظ بـ Argon على بعد تغيير واحد في الإعدادات.
تقارن هذه التدوينة النموذجين من حيث المواصفات، وصفوف المقارنات المعيارية التي تشترك فيها تدوينتا الإطلاق، ونقاط الأمن السيبراني وتكلفة مكالمة متطابقة، ثم تقدم لك قاعدة لاتخاذ القرار. للمزيد من المعلومات، انظر ما هو Gemini 4 Argon و ما هو Gemini 3.8 Flash. يعرض القسم الأخير إعداد Apidog الذي يجعل التبديل متغيرًا واحدًا.
جنبًا إلى جنب: ما يمكنك استدعاؤه اليوم
| Gemini 3.8 Flash | Gemini 4 Argon | |
|---|---|---|
| التوفر | مستقر على Gemini API و AI Studio و Antigravity و Gemini Enterprise | مجموعة فرعية من شركاء برنامج Fairwind، كنموذج مُدار على Gemini Enterprise |
| معرف النموذج | gemini-3.8-flash |
لم يتم نشره |
| السعر لكل مليون رمز (مدخل / مخرج) | 0.75 دولار / 3.75 دولار حتى 31-12-2026، ثم 1.50 دولار / 7.50 دولار | 2 دولار / 10 دولارات كعرض تقديمي (تاريخ الانتهاء غير مذكور)، ثم 4 دولارات / 20 دولارًا |
| المدخلات المخزنة مؤقتًا لكل مليون | 0.075 دولار، ثم 0.15 دولار | 0.10 دولار كعرض تقديمي، ثم 0.20 دولار (خصم 95% على المدخلات) |
| حد الإخراج | 65,536 رمزًا | مليون رمز (الحد المعلن من جوجل) |
| نافذة الإدخال | 1,048,576 رمزًا | لم يتم نشره |
| مستويات التفكير | منخفض، متوسط (افتراضي)، مرتفع؛ أدنى يُرجع HTTP 400 |
غير موثق |
| طبقة API مجانية | نعم، مع قيود على المعدل | لم يتم الإعلان عن أي |
| وصول المستهلك | تطبيق Gemini على AI Pro و Ultra، وضع الذكاء الاصطناعي في البحث | ليس بعد؛ مشتركو AI Ultra في الدفعة الأولى، ولا يوجد تاريخ محدد |
تحتاج بعض الخلايا إلى سياق. لم تنشر جوجل نافذة إدخال Argon، على الرغم من أن تقييمها الخاص للسياق الطويل استخدم مطالبات تصل إلى مليون رمز. تقول جوجل إن حد إخراج Argon هو مليون رمز؛ على الأقل أحد المقيمين من جهات خارجية، Vals AI، يدرج حدًا أقصى للإخراج يبلغ 262 ألفًا للتكوين الذي اختبره. تم تشغيل تقييمات Argon "بأعلى إعدادات التفكير،" لذا فمن المحتمل وجود مستوى عالٍ، لكن جوجل لم تسمّ المستويات أو الافتراضي. مستويات Flash موجودة في مستندات التفكير من جوجل وفي دليلنا لمستويات تفكير 3.8 Flash.
الطبقة المجانية لـ Flash محدودة المعدل، وتقول جوجل إن بيانات الطبقة المجانية "تُستخدم لتحسين منتجاتنا." لم تعلن جوجل عن أي طريقة مجانية لاستخدام Argon؛ يشرح دليل الوصول المجاني لـ Argon الخاص بنا ما يمكنك استخدامه بدلاً من ذلك.
صفوف المقارنات المعيارية التي تشترك فيها تدوينتا الإطلاق (نصيًا)
تشترك جداول إطلاق جوجل للنموذجين في صفين نصيًا. هذه أرقام أبلغت عنها جوجل، وتنسب منهجية Argon كلا الصفين إلى Vals AI.
| المقارنات المعيارية | Gemini 3.8 Flash (جدول 2 سبتمبر) | Gemini 4 Argon (جدول 30 سبتمبر) |
|---|---|---|
| Vals Finance Agent v2 | 61.4% | 65.4% |
| Harvey Legal Agent Benchmark | 10.0% | 19.6% |
نشرت جوجل هذه الجداول بفارق شهر، مقابل مجموعات منافسة مختلفة، لذا اقرأ الفجوة على أنها اتجاهية وليست اختبارًا متحكمًا فيه. ومع ذلك، يبرز صف القانون: 19.6% من Argon هو ما يقرب من ضعف 10.0% من Flash. فجوة التمويل هي 4 نقاط.
كل شيء آخر في جدول Argon ليس له نظير لـ 3.8 Flash في النص. أبلغ جدول 3.8 Flash من جوجل عن HLE-Verified، وهو ما لا يفعله جدول Argon، وظهرت درجة DeepSWE الخاصة بـ Flash فقط في صور بطاقة النموذج. في لوحة صدارة النصوص في Arena، وهو تصنيف من جهة خارجية، يحتل Argon (العالي) المرتبة الأولى في الأصوات الأولية، بينما Gemini 3.8 Flash (العالي) هو رقم 11. الجدول الكامل المكون من 19 صفًا لـ Argon، مع من قام بقياس كل صف، موجود في تفصيل مقارنات Argon المعيارية الخاص بنا.
الأمن السيبراني: Argon مقابل 3.8 Flash Cyber
تقارن صفحة الأمن السيبراني لـ DeepMind بين Argon و Gemini 3.8 Flash Cyber، الشقيق السيبراني لـ Flash المحمي بواسطة Fairwind:
| تقييم الأمن السيبراني | Gemini 4 Argon | Gemini 3.8 Flash Cyber |
|---|---|---|
| اكتشاف الثغرات الأمنية في العالم الحقيقي | 85.8% | 71.0% |
| Wiz Penetration Test Benchmark | 70.9% | 58.2% |
كلا النموذجين مقيدان بالوصول. يتوفر Gemini 3.8 Flash Cyber بشكل عام خلف قائمة سماح على منصة Gemini Enterprise Agent، و Argon مخصص لـ Fairwind فقط. إذا لم تكن شريكًا في Fairwind، فلن يغير أي من الرقمين ما يمكنك استدعاؤه اليوم. نموذج 3.8 Flash العام هو الذي يمكنك البناء عليه.
تكلفة المكالمة نفسها على كلا النموذجين
لنأخذ مكالمة واحدة بـ 100,000 رمز إدخال و 8,000 رمز إخراج. نماذج Gemini الحالية، بما في ذلك 3.8 Flash، تحاسب رموز التفكير كإخراج، لذا فإن الـ 8,000 تشملها. لم تقل جوجل كيف يحاسب Argon عليها؛ تفترض صفوف Argon أنه يتبع نماذج Gemini الحالية.
| النموذج والفترة | تكلفة الإدخال | تكلفة الإخراج | الإجمالي لكل مكالمة |
|---|---|---|---|
| 3.8 Flash، تقديمي | 0.1M x $0.75 = $0.075 | 0.008M x $3.75 = $0.030 | $0.105 |
| 3.8 Flash، اعتبارًا من 01-01-2027 | 0.1M x $1.50 = $0.150 | 0.008M x $7.50 = $0.060 | $0.210 |
| Argon، تقديمي | 0.1M x $2 = $0.200 | 0.008M x $10 = $0.080 | $0.280 |
| Argon، قياسي | 0.1M x $4 = $0.400 | 0.008M x $20 = $0.160 | $0.560 |
أسعار Argon للرمز الواحد هي 8/3 (حوالي 2.67 مرة) أسعار Flash، على كل من الأسعار التقديمية والأسعار القياسية. عند 1,000 من هذه المكالمات يوميًا، فإن ذلك يعادل 105 دولارات يوميًا على Flash مقابل 280 دولارًا على Argon بأسعار التقديم.
ثلاثة أمور تكسر هذه النسبة المنظمة:
- عدد الرموز لن يتطابق. نفس المطالبة تنتج عددًا مختلفًا من رموز الإخراج والتفكير على نماذج مختلفة. تم تشغيل تقييمات Argon المنشورة بأعلى إعدادات التفكير، وفي 3.8 Flash تحذر جوجل من أن مستويات الجهد الأعلى يمكن أن تستخدم المزيد من الرموز.
- المخرجات الطويلة تغير الحسابات. إجابة مكونة من 200,000 رمز لا تتناسب مع حد Flash البالغ 65,536 رمزًا، لذا ستقوم بتقسيمها عبر عدة مكالمات. ضمن الحد المعلن لـ Argon، تكون استجابة واحدة: 0.2M x $10 = $2.00 بأسعار التقديم، أو $4.00 بالسعر القياسي. إجابة كاملة من مليون رمز تكلف 10 دولارات كعرض تقديمي أو 20 دولارًا بالسعر القياسي.
- تاريخ انتهاء واحد فقط للأسعار التقديمية معروف. تنتهي الأسعار التقديمية لـ Flash في 31-12-2026. لم تقل جوجل متى تنتهي أسعار Argon.
يتوفر Flash أيضًا بخاصية الدفعة (Batch) بخصم 50% (0.375 دولار و 1.875 دولار حتى 31 ديسمبر)، وفقًا لصفحة أسعار Gemini API. لم تنشر جوجل أسعار الدفعة لـ Argon. دليل أسعار Argon و دليل أسعار 3.8 Flash الخاصان بنا يتعمقون أكثر.
هل يجب أن تنتظر Argon أم تعتمد على Flash؟
اعتمد على 3.8 Flash الآن عندما
- أنت مقيد بالتكلفة. يكلف Flash 3/8 من سعر Argon لكل رمز، وخاصية الدفعة (Batch) تخفض ذلك إلى النصف.
- تدير حجمًا كبيرًا. تتراكم تكاليف التصنيف والاستخراج والتوجيه والدردشة على نطاق واسع بسرعة عند 10 دولارات لكل مليون رمز إخراج.
- تحتاجه اليوم. لدى Flash معرف نموذج مستقر، وطبقة مجانية للنماذج الأولية، وجدول أسعار منشور.
- تتناسب استجاباتك مع 65,536 رمزًا. معظم أحمال عمل API تفعل ذلك.
خطط لـ Argon عندما
- العمل طويل الأمد. تقول جوجل إن Argon "مُصمم لدعم التفكير العميق عبر مسارات العمل المعقدة وطويلة الأمد."
- تحتاج إلى مخرجات تتجاوز 64 ألفًا. إعادة كتابة الوحدات النمطية بالكامل، والتقارير الطويلة، وعمليات الترحيل الكبيرة هي حالات تستدعي حد إخراج يبلغ مليون رمز.
- تدير وكلاء قانونيين أو ماليين. هذان هما الصفان اللذان نشرت جوجل فيهما كلا النموذجين، و Argon يتفوق في كليهما.
- أنت مدافع مؤهل لـ Fairwind. Argon هو النموذج الذي يقود به البرنامج الآن.
ليس عليك الاختيار مرة واحدة. وجه الجزء الأكبر من حركة المرور إلى Flash وأرسل الجزء الصعب إلى Argon عند إطلاقه، مع وجود كلاهما خلف نفس الإعدادات.
طلب محفوظ واحد، نموذجان
هذا هو النمط. احتفظ باسم النموذج في متغير بيئة، وشغّل طلباتك الحقيقية مقابل 3.8 Flash الآن، وبدّل المتغير في اليوم الذي يتم فيه إطلاق معرف نموذج Argon. لم تنشر جوجل هذا المعرف، لذا لا تخمن واحدًا.
MODEL="${GEMINI_MODEL:-gemini-3.8-flash}"
curl -s -X POST \
"https://generativelanguage.googleapis.com/v1beta/models/${MODEL}:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"contents":[{"parts":[{"text":"Summarize this contract clause in 3 bullets."}]}],
"generationConfig":{"thinkingConfig":{"thinkingLevel":"medium"},"maxOutputTokens":8192}}'
تنتهي كل استجابة generateContent بـ usageMetadata. في Apidog، قم بتخزين GEMINI_API_KEY و GEMINI_MODEL في بيئة، احفظ هذا الطلب، وأضف تأكيدات: الحالة 200، الحقول التي يقرأها تطبيقك، وحد أقصى لـ usageMetadata.thoughtsTokenCount بحجم سقف تكلفتك. حافظ على تعيين maxOutputTokens بحيث لا تستهلك إجابة طويلة ميزانيتك. أضفه إلى سيناريو اختبار، وقم بتشغيله على Flash واحتفظ بالتقرير كخط أساس.
ملاحظتان تحذيريتان ليوم الإطلاق. تقول جوجل إن "جميع النماذج الجديدة" سيتم إطلاقها على Interactions API ولم تقل ما إذا كان Argon يدعم generateContent، لذا احفظ نسخة Interactions (POST https://generativelanguage.googleapis.com/v1beta/interactions مع generation_config.thinking_level) بجانب هذه. وأسماء مستويات تفكير Argon غير موثقة، لذا قد لا ينطبق medium (متوسط). عندما يتم إطلاق Argon، قم بتغيير متغير واحد، وأعد التشغيل، وقارن المخرجات و usageMetadata جنبًا إلى جنب.
الأسئلة الشائعة
هل Gemini 4 Argon أفضل من Gemini 3.8 Flash؟ في الصفين اللذين تتشاركهما جداول الإطلاق نصيًا، نعم: 65.4% مقابل 61.4% على Vals Finance Agent v2 و 19.6% مقابل 10.0% على Harvey’s Legal Agent Benchmark. كما أنه يكلف حوالي 2.67 مرة لكل رمز، ولا يمكنك استدعاؤه بعد.
هل يجب أن أنتظر Gemini 4 Argon؟ ليس إذا كنت بحاجة إلى الإطلاق. لم تحدد جوجل تاريخ إصدار، فقط "في أقرب وقت ممكن،" بدءًا من عملاء API المدفوعين ومشتركي AI Ultra.
Gemini 3.8 Flash أم Argon لمشروع جديد؟ ابدأ بـ 3.8 Flash مع النموذج في متغير. انقل الطلبات التي تحتاج إلى مخرجات طويلة أو عمق قانوني ومالي إلى Argon بمجرد اختبارها على مطالباتك الخاصة.
هل توجد طريقة مجانية لاستخدام Argon؟ لا. لم تعلن جوجل عن طبقة مجانية؛ انظر دليل الوصول المجاني لـ Argon الخاص بنا لنماذج Gemini المجانية التي يمكنك استخدامها اليوم.
هل يحل Argon محل Gemini 3.8 Flash؟ لم تقل جوجل ذلك. تصف جوجل Argon بأنه نموذجها الرائد الجديد، وتشير رويترز إلى أنه أكبر من خط Pro السابق، لذا فهو في مستوى مختلف عن Flash.
الخطوة التالية
قم بإعداد الطلب اليوم، وقم بتشغيله على 3.8 Flash، واحفظ التقرير. عندما يتم إطلاق Argon، ستعرف في غضون دقائق ما إذا كان يستحق سعره على حركة مرورك. قم بتنزيل Apidog لإنشاء المقارنة.
