شُحنت أو أعيد تسعير ثلاث واجهات برمجة تطبيقات رائدة في غضون أسبوع واحد، وتقع هذه الواجهات ضمن ثلاثة نطاقات سعرية مختلفة. أصدرت جوجل Gemini 3.8 Flash في 2 سبتمبر 2026 بسعر 0.75 دولار لكل مليون توكن إدخال و 3.75 دولار لكل مليون توكن إخراج. أصدرت أنثروبيك Claude Fable 5.1 في اليوم السابق بسعر 10 دولارات و 50 دولارًا. ويقع GPT-5.6 Sol من OpenAI بينهما بسعر 5 دولارات و 30 دولارًا. وفي مؤشر الذكاء المستقل الخاص بـ Artificial Analysis، حصلت النماذج الثلاثة على درجات 59 و 57 و 59. هذه هي المقارنة الكاملة في جملة واحدة: نموذج سعره يعادل حوالي جزء من ثلاثة عشر من الفئة العليا يحصل على نفس الدرجة على المؤشر الوحيد الذي يختبر الثلاثة بنفس الطريقة.
الخدعة تكمن في كلمة "مؤشر". تقيس المعايير الإجابات لكل مهمة. فاتورتك تحسب التوكنات لكل مهمة، و Gemini 3.8 Flash مصمم لإنفاق المزيد منها. يضع هذا الدليل النماذج الثلاثة جنبًا إلى جنب من حيث المواصفات، وجداول جوجل المعيارية الخاصة (حيث يغيب Fable 5.1، ونشرح السبب)، والأرقام المستقلة لـ Artificial Analysis، وحسابات الأسعار. ثم يقدم قاعدة بسيطة لتحديد واجهة برمجة التطبيقات التي تناسب أي عبء عمل. يغطي مقال Gemini 3.8 Flash الأساسي النموذج بشروطه الخاصة، و منشور إطلاق جوجل هو المصدر الأساسي لكل ادعاء لجوجل أدناه.
ملاحظة واحدة حول التوقيت. قارنت مقارنتنا بين Gemini 3.7 Flash و Claude و GPT من أغسطس مع Claude Fable 5، وليس 5.1. استبدلت أنثروبيك هذا النموذج في 1 سبتمبر، لذا هذه مقارنة جديدة، وليست تحديثًا.
المواصفات في لمحة
| Gemini 3.8 Flash | Claude Fable 5.1 | GPT-5.6 Sol | |
|---|---|---|---|
| المورد | جوجل | أنثروبيك | OpenAI |
| نافذة السياق | 1,048,576 توكن | 1 مليون توكن | 1 مليون توكن |
| الحد الأقصى للإخراج | 65,536 توكن | 128 ألف توكن | 128 ألف توكن |
| سعر الإدخال (لكل 1 مليون) | 0.75 دولار تمهيدي، 1.50 دولار من 1 يناير 2027 | 10 دولارات | 5 دولارات |
| سعر الإخراج (لكل 1 مليون) | 3.75 دولار تمهيدي، 7.50 دولار من 1 يناير 2027 | 50 دولارًا | 30 دولارًا |
| قراءة الكاش (لكل 1 مليون) | 0.075 دولار تمهيدي، 0.15 دولار من 1 يناير | 0.25 دولار | 0.50 دولار |
| تاريخ قطع المعرفة | مارس 2026 | يونيو 2026 | غير مدرج هنا |
| التحكم في التفكير | thinking_level منخفض / متوسط / مرتفع (المتوسط هو الافتراضي) |
تفكير موسع، دائمًا مفعل | مستويات جهد تصل إلى xhigh |
| مؤشر Artificial Analysis | 59 (مرتفع) | 57 (متوسط) | 59 (xhigh) |
يبرز أمران قبل أي معيار. Gemini 3.8 Flash لديه نصف الحد الأقصى للإخراج مقارنة بالنموذجين الآخرين، 65,536 توكن مقابل 128 ألف، وهو ما يهم المستندات الطويلة ذات اللقطة الواحدة أكثر من حلقات الوكلاء التي تصدر خطوات قصيرة. وينتهي سعره التمهيدي في 31 ديسمبر 2026: فمن 1 يناير تتضاعف معدلات Gemini، مما يغير كل نسبة في هذا المقال. يشرح دليل تسعير Gemini 3.8 Flash بالتفصيل معدلات المضاعفة والتخزين المؤقت والدُفعات والتأسيس.
الرقم المستقل: 59، 57، 59
تُجري Artificial Analysis نفس التقييمات التسعة على كل نموذج وتنشر درجة واحدة لمؤشر الذكاء. Gemini 3.8 Flash بمستوى التفكير المرتفع يحقق 59 نقطة، بزيادة من 56 لـ 3.7 Flash و 52 لـ 3.6 Flash. GPT-5.6 Sol بمستوى جهد xhigh يحقق أيضًا 59 نقطة. Claude Fable 5.1 بمستوى جهد متوسط يحقق 57 نقطة، متعادلًا مع GPT-5.6 Terra في أقصى إعداد و Muse Spark 1.2 في إعداد xhigh. Grok 4.6 في المستوى المتوسط هو النموذج الآخر الذي يحقق 59 نقطة.
اقرأ تسميات مستوى التفكير قبل قراءة الأرقام. تم اختبار Fable 5.1 في المستوى المتوسط، وليس أعلى إعداداته، و Sol في مستوى xhigh، وهو أعلى إعداداته. فجوة النقطتين عبر مستويات جهد مختلفة ليست ترتيبًا، وتُدرجها Artificial Analysis بهذه الطريقة لسبب. البيان القابل للدفاع أضيق: في الإعدادات المختبرة، يتطابق Gemini 3.8 Flash مع النموذجين المتميزين على هذا المؤشر، وهو النموذج الأقل تكلفة عند 59 بفارق كبير.
قاس نفس التقرير تكلفة هذه النتيجة. استخدم Gemini 3.8 Flash في المستوى المرتفع 48,000 توكن إخراج لكل مهمة في المتوسط، بزيادة 30 بالمائة عن 3.7 Flash، وتكلفة 0.58 دولار لكل مهمة في إنفاق واجهة برمجة التطبيقات. كان الوقت لكل مهمة 2.5 دقيقة، وسرعة الإخراج حوالي 300 توكن في الثانية، والوقت حتى أول توكن 13.3 ثانية في تشغيل التفكير المرتفع لأن النموذج يفكر قبل أن يكتب. في تقييم τ³-Banking لاستخدام الأدوات، سجل 45 بالمائة، بزيادة 12 نقطة عن 3.7 Flash. ضع هذه الأرقام في اعتبارك عندما يبدو السعر لكل توكن جيدًا جدًا.
جداول جوجل المعيارية ومن هو المفقود
تنشر صفحة Flash من جوجل ثلاثة صفوف عابرة للموردين في شكل نصي. لا يتواجد Claude Fable 5.1 فيها. تحتوي جداول جوجل على Anthropic’s Opus 5 و Sonnet 5 بدلاً من ذلك، وكان Fable 5.1 قد صدر للجمهور قبل يوم واحد فقط من نشر الجداول. لذا، فإن عمود Anthropic أدناه هو Opus 5 (5 دولارات / 25 دولارًا) و Sonnet 5 (2 دولار / 10 دولارات)، وليس نموذج 10 دولارات / 50 دولارًا الذي يدور عنه هذا المقال. تعامل معه على أنه أفضل بديل متاح، وليس تطابقًا مباشرًا.
| المعيار (تديره جوجل) | Gemini 3.8 Flash | Claude Opus 5 | Claude Sonnet 5 | GPT-5.6 Sol | GPT-5.6 Terra |
|---|---|---|---|---|---|
| HLE-Verified | 54.9% | 54.4% | 31.0% | 54.5% | 51.1% |
| Vals Finance Agent v2 | 61.4% | 58.6% | 53.9% | 53.8% | 54.4% |
| Harvey Legal Agent Benchmark | 10.0% | 6.7% | 5.0% | 2.5% | 0.8% |
HLE-Verified هو تعادل ثلاثي: 54.9، 54.4، و 54.5 تقع ضمن نصف نقطة من بعضها البعض، مع Sonnet 5 بفارق كبير. Vals Finance Agent v2 هو حيث ينفصل 3.8 Flash، بـ 2.8 نقطة فوق Opus 5 و 7.6 فوق Sol في مهمة مالية وكيلة متعددة الخطوات. Harvey Legal هو الغريب: كل نموذج يسجل أقل من 11 بالمائة، لذا فإن الترتيب يقول أكثر من الفروقات.
ما لم تنشره جوجل في شكل نصي لا يقل أهمية. لا توجد أرقام لـ SWE-Bench Pro، Terminal-bench، أو OSWorld لـ 3.8 Flash، وتظهر نتيجة DeepSWE v1.1 فقط كادعاء بأن النموذج "يتفوق على معظم النماذج الحدودية الأكبر" بـ "جزء صغير من التكلفة"، مع وجود الرقم في جدول صور، وليس في نص. لمقارنات البرمجة واستخدام الكمبيوتر، عليك الذهاب إلى عمليات التشغيل الخاصة بكل بائع، والتي لا تتداخل. تتوفر بيانات Anthropic في تفاصيل معايير Claude Fable 5.1؛ وتتوفر بيانات OpenAI في معايير GPT-5.6 Sol. لم يُشغّل أي بائع نموذج الآخر، لذا تظل Artificial Analysis المصدر الوحيد للمقارنة المتكافئة.
فجوة الأسعار، سطرًا بسطر
بأسعار تقديمية، الحسابات واضحة. سعر إدخال Fable 5.1 البالغ 10 دولارات هو 13.3 مرة سعر Gemini 3.8 Flash البالغ 0.75 دولار، وسعر إخراجه البالغ 50 دولارًا هو 13.3 مرة سعر 3.75 دولار. سعر إدخال GPT-5.6 Sol البالغ 5 دولارات هو 6.7 مرة، وسعر إخراجه البالغ 30 دولارًا هو 8 مرات. تقلص عمليات قراءة الذاكرة المؤقتة (cache) الفارق: 0.075 دولار على 3.8 Flash، و 0.25 دولار على Fable 5.1 (3.3x)، و 0.50 دولار على Sol (6.7x). قراءة ذاكرة التخزين المؤقت لـ Fable 5.1 هي نصف ما لدى Sol، وهو السطر الوحيد الذي لا يكون فيه النموذج الأغلى هو الأغلى.
مثال عملي يجعل الأمر ملموسًا. لنأخذ عملية تستهلك مليون توكن إدخال و 200,000 توكن إخراج، كلها غير مخبأة.
- Gemini 3.8 Flash: 0.75 دولار + 0.75 دولار = 1.50 دولار
- GPT-5.6 Sol: 5.00 دولار + 6.00 دولار = 11.00 دولار
- Claude Fable 5.1: 10.00 دولار + 10.00 دولار = 20.00 دولار
من 1 يناير 2027، ستكلف نفس عملية Gemini 3.00 دولارات، وتتقلص الفجوات إلى 3.7x لـ Sol و 6.7x لـ Fable 5.1. ينطبق التضاعف أيضًا على 3.6 Flash و 3.7 Flash، لذا لا يوجد Gemini Flash أرخص يمكن الرجوع إليه. تُدرج صفحة تسعير Anthropic أسعار Fable 5.1، ويغطي دليل تسعير Claude Fable 5.1 و دليل تسعير GPT-5.6 فئات الدفعات والتخزين المؤقت لكل منهما.
التكلفة لكل مهمة، وليس لكل توكن
هنا التحذير الذي يلغي النسخة المبسطة من تلك المعادلة. تقول جوجل إن Gemini 3.8 Flash "يمكنه استخدام المزيد من التوكنات في المهام الأطول والأكثر تعقيدًا، حسب التصميم". في المشكلات الصعبة، يتخذ خطوات تفكير أصغر، ويتحقق من عمله، ويستدعي الأدوات بشكل متكرر. قاسّت Artificial Analysis التأثير: 48,000 توكن إخراج لكل مهمة في المستوى المرتفع، بزيادة 30 بالمائة عن 3.7 Flash، لذا ارتفعت تكلفة تشغيل مؤشرها من 0.40 دولار لكل مهمة على 3.7 Flash إلى 0.58 دولار على 3.8 Flash بأسعار توكنات لم تتغير. في المستوى المتوسط تبلغ 0.41 دولار لكل مهمة وفي المستوى المنخفض 0.24 دولار.
تترتب على ذلك نتيجتان. أولاً، فجوة 13.3 ضعف لكل توكن ليست فجوة فواتير 13.3 ضعف إذا أكمل النموذج المتميز المهمة بعدد أقل من التوكنات أو عدد أقل من استدعاءات الأدوات. لم تنشر Artificial Analysis رقمًا متكافئًا لكل مهمة لـ Fable 5.1 أو Sol في النص المتوفر لدينا، لذا قم بقياسه على استعلاماتك الخاصة قبل الثقة بأي من اتجاهات المضاعفة. ثانيًا، في Gemini، مستوى التفكير هو المحرك الرئيسي للتكلفة. خفض المسار من مستوى عالٍ إلى منخفض خفض تكلفة المهمة بأكثر من النصف في مجموعة Artificial Analysis، ويوضح دليل مستويات التفكير كيفية ضبطه لكل نقطة نهاية. تغطي مقارنة 3.8 Flash مقابل 3.7 Flash الحالة التي يكون فيها النموذج الأقدم، بتكلفة أقل بنسبة 31 بالمائة لكل مهمة، لا يزال هو الخيار الأفضل.
متى تختار كل منها
اختر Gemini 3.8 Flash للحجم الكبير والوكلاء بتكلفة منخفضة
إذا كنت تشغل آلاف المهام للوكلاء يوميًا، فإن 3.8 Flash هو الخيار الافتراضي. فهو يتطابق مع النماذج المميزة في المؤشر المستقل، ويتصدر جداول وكلاء جوجل الماليين والقانونيين، ويكلف جزءًا صغيرًا لكل توكن حتى بعد مضاعفة الأسعار في يناير. كما أنه يقبل مدخلات الفيديو والصوت وPDF بشكل أصلي، ويوفر خدمة الدُفعة بخصم 50 بالمائة، ويشمل 5000 طلب مجاني لتأسيس بحث جوجل شهريًا، ولديه مستوى مجاني للنماذج الأولية. المقايضات: إخراج نصي فقط، لا يوجد Live API، حد أقصى للإخراج يبلغ 65,536 توكن، وشهية للتوكنات يجب أن تضع لها ميزانية في المستوى المتوسط أو المرتفع.
اختر Claude Fable 5.1 لأصعب استدلال طويل الأمد
Fable 5.1 هو النموذج الذي يجب التصعيد إليه، وليس البدء به. حالته هي الأعمال التي تكون فيها الإجابة الخاطئة أكثر تكلفة من التوكنات: وكلاء البحث لساعات طويلة، جلسات طرفية طويلة، سلاسل استدلال حيث لا تفي تقييمات النموذج الأرخص بالغرض. إن إخراجه البالغ 128 ألف توكن وعمليات قراءة الكاش البالغة 0.25 دولار تناسب حلقات الوكلاء ذات البادئة الكثيرة التي تعيد استخدام نفس السياق الكبير في كل دورة؛ في هذه الحالات، يجعل خط الكاش المضاعف الفعال أصغر بكثير من 13.3 ضعفًا. انظر ما هو Claude Fable 5.1 للحصول على ورقة المواصفات الخاصة بالنموذج.
اختر GPT-5.6 Sol لتشغيل وكلاء نظام OpenAI البيئي
يسجل Sol 59 نقطة في xhigh، ويتعادل مع 3.8 Flash في HLE-Verified، ويتم شحنه بإخراج 128 ألف توكن بسعر 5 دولارات / 30 دولارًا. إذا كانت وكلاءك وتقييماتك وأدواتك موجودة بالفعل في حزمة OpenAI، فإن Sol هو الطبقة المميزة التي لا تتطلب موردًا ثانيًا. لديه أغلى قراءات ذاكرة تخزين مؤقت بين الثلاثة، لذا فهو يناسب عمليات التشغيل ذات السياق الجديد بشكل أفضل من الجلسات المخزنة مؤقتًا الطويلة. تُظهر مقارنة Grok 4.6 vs GPT-5.6 vs Claude Fable 5 كيف صمد Sol أمام الرائد السابق لـ Anthropic.
اختبر الثلاثة في مساحة عمل واحدة في Apidog
كل حجة أعلاه تنتهي بنفس الطريقة: قسها على استعلاماتك الخاصة. Apidog هو عميل ومنصة اختبار واجهات برمجة التطبيقات، لذا فهو لا يشغل أيًا من هذه النماذج، ولكنه طريقة سريعة لإرسال نفس الطلب إلى جميع الموردين الثلاثة ومقارنة ما يعود.
الإعداد هو مشروع واحد بثلاث بيئات. تحتوي كل بيئة على عنوان URL أساسي ومتغير مفتاح: https://generativelanguage.googleapis.com مع GEMINI_API_KEY، وقاعدة Anthropic مع مفتاح Claude الخاص بك، وقاعدة OpenAI مع مفتاح OpenAI الخاص بك. تظل المفاتيح في متغيرات البيئة، ولا تكون أبدًا في نص الطلب أو المجموعة المشتركة.
ثم قم ببناء سيناريو اختبار واحد بثلاث خطوات طلب تحمل نفس الاستعلام. خطوة Gemini تنشر إلى /v1beta/interactions مع "model": "gemini-3.8-flash" و "thinking_level": "medium"؛ والخطوتان الأخريان تنشران إلى نقطة نهاية الدردشة أو الرسائل الخاصة بمورديهما. في كل خطوة، أضف تأكيدات مهمة للمقارنة: HTTP 200، مسار JSON يؤكد وجود الإجابة، وحد أقصى لحقل استخدام التوكن بحيث تفشل عملية تستخدم فجأة ضعف عدد توكنات التفكير بشكل صريح. في Gemini، هذا الحقل هو usageMetadata.thoughtsTokenCount لنقطة النهاية القديمة؛ قم بالتأكيد على كتلة الاستخدام المكافئة للنموذجين الآخرين.
قم بتشغيل السيناريو مقابل مجموعة من الاستعلامات الذهبية، ثم قم بجدولته بحيث يعمل يوميًا. عندما يغير مورد الإعدادات الافتراضية أو يبدأ نموذج في إنفاق المزيد من التوكنات، فإن التأكيد الفاشل يخبرك بذلك قبل أن تصل الفاتورة. يغطي دليل اختبار واجهة برمجة تطبيقات وكيل الذكاء الاصطناعي النسخة متعددة الأدوار من هذا النمط، ويغطي جدولة اختبارات واجهة برمجة التطبيقات في Apidog التشغيل المتكرر. قم بتنزيل Apidog لإعداد البيئات الثلاث.
الأسئلة الشائعة
هل Gemini 3.8 Flash أفضل من Claude Fable 5.1؟
في مؤشر Artificial Analysis، يسجل 3.8 Flash في المستوى المرتفع 59، و Fable 5.1 في المستوى المتوسط يسجل 57، لذا فهما متقاربان في الإعدادات المختبرة. جداول جوجل لا تتضمن Fable 5.1، ومعايير Anthropic لا تتضمن 3.8 Flash، لذا لا توجد مقارنة أوسع مباشرة. لكل توكن، Flash أرخص بـ 13.3 مرة بأسعار تمهيدية.
أي من الثلاثة هو الأرخص لأعباء عمل الوكيل؟
Gemini 3.8 Flash بفارق كبير لكل توكن، بسعر 0.75 دولار / 3.75 دولار حتى 31 ديسمبر 2026. لكل مهمة، قيست Artificial Analysis 0.58 دولار في المستوى المرتفع، و 0.41 دولار في المستوى المتوسط، و 0.24 دولار في المستوى المنخفض، لأن النموذج ينفق حوالي 30 بالمائة توكنات إخراج أكثر من 3.7 Flash. قم بقياس التكلفة لكل مهمة مكتملة، وليس لكل توكن، قبل الالتزام.
هل تحتوي النماذج الثلاثة جميعها على نافذة سياق بحجم 1 مليون؟
نعم. يقبل Gemini 3.8 Flash ما يصل إلى 1,048,576 توكن إدخال، ويُدرج كل من Fable 5.1 و GPT-5.6 Sol 1 مليون توكن. يختلف الحد الأقصى للإخراج: 65,536 توكن في 3.8 Flash مقابل 128 ألف توكن في النموذجين الآخرين.
لماذا لا يوجد Claude Fable 5.1 في جداول جوجل المعيارية؟
تُدرج الصفوف المنشورة من جوجل Claude Opus 5 و Claude Sonnet 5 كإدخالات لـ Anthropic. شُحن Fable 5.1 في 1 سبتمبر، قبل يوم واحد من 3.8 Flash، لذلك لم يتم تضمينه. للحصول على أرقام Fable 5.1 الخاصة التي تديرها Anthropic، انظر مقارنة Claude Fable 5.1 vs Opus 5.
هل تستمر ميزة سعر Gemini بعد عام 2027؟
جزئياً. اعتبارًا من 1 يناير 2027، ينتقل سعر Gemini 3.8 Flash إلى 1.50 دولار / 7.50 دولار، مما يجعل Fable 5.1 بسعر 6.7x على كلا الخطين و Sol بسعر 3.3x على الإدخال و 4x على الإخراج. لا يزال أرخص، ولكن بفارق النصف.
أيها تختار أولاً
ابدأ بـ Gemini 3.8 Flash لأي شيء تشغله بكميات كبيرة، اضبط thinking_level لكل مسار، وراقب التوكنات لكل مهمة، وليس السعر المعلن. ارتقِ إلى Claude Fable 5.1 عندما لا تفي تقييماتك على النماذج الأرخص بالغرض ويتم تخزين السياق مؤقتًا عبر الأدوار. استخدم GPT-5.6 Sol عندما تكون بقية مجموعتك تعمل بـ OpenAI وترغب في طبقة متميزة دون مورد ثانٍ. أيًا كان ما تختاره، قم بتشغيل نفس الاستعلام عبر النماذج الثلاثة في سيناريو اختبار واحد أولاً؛ نسبة السعر عامة، ولكن نسبة التكلفة لكل مهمة على استعلاماتك هي لك لتقيسها بنفسك.
