أطلقت Google نموذج Gemini 3.7 Flash في 13 أغسطس 2026، بعد ثلاثة أسابيع من إطلاق 3.6 Flash، ووصفت "نموذجها العامل الأكثر ذكاءً". تدعم دلتا المقارنة المعيارية هذه الثقة. فقد قفز DeepSWE من 49.0% إلى 65.3%، وارتفع AutomationBench من 17.0% إلى 30.4%، ووصل السعر الافتتاحي البالغ 0.75 دولار لكل مليون رمز إدخال إلى نصف تكلفة 3.6 Flash عند الإطلاق.
هذا المزيج يثير سؤالاً تواجهه كل فرق واجهات برمجة التطبيقات (API) هذا الربع: هل يغطي نموذج Gemini السريع والرخيص الآن أعباء العمل التي كنت توجهها إلى Claude أو GPT؟ تلتزم هذه المقارنة بما يمكنك التحقق منه: نوافذ السياق، والوسائط المتعددة، ودعم الأدوات، وهيكل التسعير، ومخططات الطلبات التي ستدمجها؛ وحيثما تكون أرقام المنافسين غير قابلة للمقارنة، فإنه يشير إلى ذلك. ونظرًا لأن الإجابة الصادقة على سؤال "أي واجهة برمجة تطبيقات يجب أن تستخدم" هي "تلك التي تتفوق في عبء عملك"، فإن القسم الأخير يوضح كيفية تشغيل الثلاثة جنبًا إلى جنب في Apidog قبل الالتزام.
إذا انتهى بك الأمر باختيار Gemini وتريد خطوات الإعداد، فإن دليل البدء السريع لواجهة برمجة تطبيقات Gemini 3.7 Flash يغطي المفاتيح ونقاط النهاية والطلبات الأولى.
ملخص سريع
- Gemini 3.7 Flash: سياق 1 مليون رمز، حد إخراج 64 ألف رمز، إدخال أصلي عبر النصوص والصور والفيديو والصوت وPDF، بالإضافة إلى استدعاء الوظائف، والبحث كأداة، واستخدام الكمبيوتر.
- التسعير التمهيدي: 0.75 دولار لكل مليون رمز إدخال و3.75 دولار لكل مليون رمز إخراج حتى 31 ديسمبر 2026، ويتضاعف إلى 1.50 دولار و7.50 دولار في 1 يناير 2027.
- مكاسب الترميز مقارنة بـ 3.6 Flash: DeepSWE v1.1 من 49.0% إلى 65.3%، FrontierCode 1.1 Main من 34.4% إلى 43.6%، AutomationBench من 17.0% إلى 30.4%.
- Claude Fable 5 و GPT-5.6 Sol لا يزالان يتفوقان في عمق الترميز المتطور واتساق الوكيل، وذلك بسعر أعلى عدة مرات لكل رمز.
- يستخدم المزودون الثلاثة مخططات طلب غير متوافقة: Google
contents، Anthropic Messages، OpenAImessages. - تتنبأ المعايير بالمتوسطات، وليس بعبء عملك؛ قم بإجراء اختبار لـ 20 مطالبة عبر واجهات برمجة التطبيقات الثلاثة قبل اتخاذ القرار.
كيف تقرأ هذه المقارنة
هذه ليست مواجهة بين النماذج الرائدة. Claude Fable 5 و GPT-5.6 Sol هما نماذج رائدة بأسعار تعكس أقصى قدرة؛ Gemini 3.7 Flash هو نموذج عامل ذو كفاءة عالية بأسعار مناسبة للحجم. تُطلقه Google بينما ينتظر نموذجها الرائد: ذكرت Axios أن Gemini 3.5 Pro لا يزال متأخرًا، مع إطلاق تحديثات Flash قبله.
لا تزال المقارنة تستحق العناء: تتداخل نتائج إطلاق 3.7 Flash الآن مع النطاق الذي كانت فيه النماذج الرائدة قبل أسابيع، وهذا يغير حسابات التوجيه حتى لو بقيت النماذج الرائدة متقدمة.
تطبق حذيران في جميع أنحاء النص. أولاً، كل رقم هنا هو رقم تم الإبلاغ عنه من قبل البائع في الأسبوع الأول من الإطلاق؛ تعامل معه كدليل حتى تظهر التقييمات المستقلة. ثانيًا، تختلف متغيرات المعايير. تورد Google نتائج FrontierCode 1.1 Main، بينما جاءت الأرقام المنشورة لـ Claude و GPT عند إطلاقهما من تقسيم Extended، لذا لا تشارك هذه الأعمدة جدولاً هنا أبدًا.
المواصفات جنبًا إلى جنب
تُظهر ورقة المواصفات كيف يتماسك Gemini 3.7 Flash أمام نماذج تكلف أكثر بكثير. تتوفر التفاصيل الفنية الكاملة على صفحة نموذج Gemini Flash.
| Gemini 3.7 Flash | Claude Fable 5 | GPT-5.6 Sol | |
|---|---|---|---|
| المطور | جوجل | أنثروبيك | أوبن إيه آي |
| نافذة السياق | 1 مليون رمز | 1 مليون رمز | 1.05 مليون رمز |
| حد الإخراج | 64 ألف رمز | راجع وثائق المزود | راجع وثائق المزود |
| وسائط الإدخال | نص، صورة، فيديو، صوت، PDF | نص، صورة | نص، صورة |
| الإخراج | نص | نص | نص |
| دعم الأدوات | استدعاء الوظائف، البحث كأداة، استخدام الكمبيوتر | استدعاء الوظائف، استخدام الأدوات | استدعاء الوظائف، أدوات مدمجة |
| مخطط الطلب | Google contents + generationConfig |
Anthropic Messages | OpenAI messages |
| المصادقة | رأس x-goog-api-key |
رأس x-api-key + إصدار |
رمز حامل (Bearer token) |
| التسعير (لكل مليون رمز) | 0.75 دولار إدخال / 3.75 دولار إخراج تمهيدي؛ 1.50 دولار / 7.50 دولار من يناير 2027 | فئة متميزة متقدمة | فئة متميزة متقدمة |
| الموضع | نموذج عامل عالي الكفاءة | عمل الوكيل طويل الأمد | عمق ترميز على مستوى المستودع |
أصبحت نوافذ السياق الآن متساوية فعليًا، لذا لم يعد هذا الصف يقرر أي شيء. صفوف الوسائط المتعددة والتسعير هي حيث تختلف النماذج الثلاثة، وستقوم الأقسام التالية بتوضيح كليهما.
مهام البرمجة والوكيل
تتمحور ادعاءات Google الرئيسية لـ 3.7 Flash حول المطورين: أفضل في تصحيح الأخطاء، وأكثر قدرة على إنتاج كود قابل للنشر من المحاولة الأولى، وأكثر دقة في التخطيط متعدد الخطوات واستدعاءات الأدوات. الأرقام من جيل إلى جيل، المؤكدة في تغطية 9to5Google للإطلاق، تدعم هذه الادعاءات.
| المعيار | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|
| DeepSWE v1.1 (إصلاحات على مستوى المستودع) | 49.0% | 65.3% |
| FrontierCode 1.1 Main | 34.4% | 43.6% |
| WebDev Arena (إيلو) | 1538 | 1588 |
| GDP.pdf (استنتاج المستندات) | 22.0% | 34.0% |
| AutomationBench (مهام الوكيل) | 17.0% | 30.4% |
قفزة AutomationBench هي التي يجب أن يركز عليها بناة الوكلاء. إن مضاعفة معيار وكلاء تقريبًا في ثلاثة أسابيع يشير إلى أن ادعاء "يفكر بجدية أكبر في استدعاءات الأدوات" هو أكثر من مجرد تسويق.
كيف يقارن ذلك بـ Claude و GPT؟ في DeepSWE v1.1، سجلت الفئة الرائدة 73.0% لـ GPT-5.6 Sol Max عند إطلاقها، بينما سجل Grok 4.6 65.9%؛ تغطي مقارنتنا بين Grok 4.6 و GPT-5.6 Sol و Claude Fable 5 تلك النتائج بعمق. يحتفظ Sol Max بتقدم حقيقي في إصلاح الأخطاء على مستوى المستودع، وتكمن قوة Claude Fable 5 في الاتساق عبر تقييمات الترميز والوكلاء، حيث نادرًا ما يكون أسوأ من المركز الثاني. لم يسد Gemini 3.7 Flash تلك الفجوة. لقد وصل إلى مسافة قريبة جدًا بجزء بسيط من التكلفة، وهو عرض قيمة مختلف عن "أفضل نتيجة تفوز".
يكمل رقمان متخصصان الصورة: 90.7% على Harvey LAB-AA للاستدلال القانوني، و 97.0% على استرجاع 128 ألف إبرة (128k-needle retrieval)، وهي النتيجة التي تجعل نافذة 1 مليون موثوقة عمليًا.
المدخلات المتعددة الوسائط
هذا هو أوضح فرق هيكلي بين واجهات برمجة التطبيقات الثلاثة. يقبل Gemini 3.7 Flash النصوص والصور والفيديو والصوت وملفات PDF في نفس مصفوفة contents مقابل نقطة نهاية واحدة. يتعامل Claude و GPT مع النصوص والصور بشكل جيد، لكن أعباء عمل الفيديو والصوت عادة ما توجه عبر خطوات نسخ أو معالجة مسبقة منفصلة قبل أن يصل النص إلى النموذج.
إذا كان منتجك يتعامل مع المستندات، فإن قفزة GDP.pdf من 22.0% إلى 34.0% هي الإشارة ذات الصلة: يقيس هذا المعيار الاستنتاج عبر ملفات PDF الواقعية التي تحتوي على جداول ومسح ضوئي وتخطيطات مكسورة. يزيل تغذية عقد أو فاتورة مباشرة إلى النموذج بدون مسار OCR مرحلة كاملة معرضة للفشل من بنيتك.
القاعدة العملية: بالنسبة لمحادثات النصوص والصور، فإن تعدد الوسائط متساوٍ. أما بالنسبة لإطارات الفيديو، أو تسجيلات المكالمات، أو أكوام المستندات، فإن Gemini هو الوحيد من بين الثلاثة الذي ينهار فيه مسار الإدخال إلى استدعاء API واحد.
فلسفة التسعير
يعتمد المزودون الثلاثة استراتيجيات تسعير مختلفة، ويخبرك الفرق بمن يستهدف كل نموذج.
تُسعِّر Google نموذج 3.7 Flash لاقتناص السوق. يظل السعر التمهيدي البالغ 0.75 دولار لكل مليون رمز إدخال و 3.75 دولار لكل مليون رمز إخراج ساريًا حتى 31 ديسمبر 2026، وهو نصف تكلفة 3.6 Flash عند الإطلاق. في 1 يناير 2027، يبدأ السعر القياسي عند 1.50 دولار و 7.50 دولار، أي مضاعفة واضحة. هذا الموعد النهائي هو عامل ضغط: تريد Google التزامك بالاستخدام قبل إعادة تعيين السعر. التفاصيل الكاملة لحساب الرموز، مع أمثلة عملية لروبوتات الدردشة وحلقات الوكلاء، موجودة في تحليل تسعير Gemini 3.7 Flash الخاص بنا.
تُسعِّر Anthropic و OpenAI نماذجهما الرائدة كقدرات متميزة. تختلف الأسعار حسب الفئة وتتغير غالبًا، لكن الشكل ثابت: تكلف رموز الإخراج الرائدة عدة أضعاف ما يفرضه Flash، ويبيع كلا المزودين القيمة المضافة في عدد أقل من التشغيلات الفاشلة، وليس في رموز أرخص. تضيف Anthropic معلمة جهد توازن التكلفة مقابل القدرة داخل نموذج واحد؛ بينما تقوم OpenAI بتصنيفها عبر أحجام النماذج بدلاً من ذلك.
تعتمد الفلسفة الفائزة على اقتصاديات الفشل لديك. نموذج رخيص يفشل في مهمة ينشئ عمل إصلاح يكلف أكثر من الرموز الموفرة؛ نموذج متميز يكسب سعره فقط عندما يمنع هذه الإخفاقات. قارن التكلفة لكل مهمة مكتملة، وليس التكلفة لكل رمز، وأعد تسعيرها بعد 1 يناير 2027 عندما تتضاعف أسعار Gemini.
تصميم واجهة برمجة التطبيقات (API Ergonomics)
اختلافات المخطط هي الضريبة التي تدفعها عند التبديل بين المزودين أو التوجيه بينهم. إليك نفس الطلب ذو الدورة الواحدة بأشكاله الثلاثة.
تغلف واجهة برمجة تطبيقات Gemini من Google الأدوار في contents باستخدام parts، وتعيش إعدادات التوليد في generationConfig:
{
"contents": [
{ "role": "user", "parts": [{ "text": "Summarize this changelog." }] }
],
"generationConfig": { "temperature": 0.3, "maxOutputTokens": 1024 }
}
تضع واجهة برمجة تطبيقات Messages من Anthropic النموذج و max_tokens المطلوب في المستوى الأعلى، مع المطالبة النظامية كحقل خاص بها:
{
"model": "claude-fable-5",
"max_tokens": 1024,
"system": "You summarize changelogs in three bullets.",
"messages": [{ "role": "user", "content": "Summarize this changelog." }]
}
تدمج OpenAI المطالبة النظامية في مصفوفة messages نفسها:
{
"model": "gpt-5.6-sol",
"messages": [
{ "role": "system", "content": "You summarize changelogs in three bullets." },
{ "role": "user", "content": "Summarize this changelog." }
]
}
تبدو حالة النص قريبة بما يكفي للتغطية بمحول. استخدام الأدوات هو حيث يتسرب التجريد: تعلن Google عن الوظائف في مصفوفة tools مع functionDeclarations وتتحكم في الاستدعاء من خلال toolConfig، وتستخدم Anthropic مخطط أدواتها الخاص مع كتل استجابة مختلفة، ولدى OpenAI تنسيق وظائفها الخاص مرة أخرى. تختلف أشكال أجزاء البث أيضًا، على الرغم من أن الثلاثة يعتمدون على أحداث مرسلة من الخادم. تعمل البوابات ونقاط النهاية المتوافقة على تطبيع شكل الدردشة الأساسي، لكن أجزاء الوسائط المتعددة واستدعاءات الأدوات نادرًا ما تنجو من الترجمة بشكل نظيف؛ لقد وثقنا نفس المشكلة عبر البائعين في مقارنة تنسيقات API لـ DeepSeek V4 Pro.
نصيحة التكامل غير جذابة: حافظ على طبقة مزود رقيقة بين منتجك والنموذج. الفرق التي تفعل ذلك تتحول بين المزودين في أيام بدلاً من أرباع.
متى تختار كل واحد
معايير ومخططات مكثفة في قائمة قرارات:
- اختر Gemini 3.7 Flash لحركة وكلاء عالية الحجم، مسارات وسائط متعددة تستقبل الفيديو أو الصوت أو ملفات PDF، وأي عبء عمل يحد فيه تكلفة كل استدعاء من هامش المنتج. إنه أيضًا صندوق رمل واضح لتجارب استخدام الكمبيوتر؛ يغطي تحليلنا لاستخدام الكمبيوتر مقابل واجهات برمجة التطبيقات المنظمة متى تستحق هذه القدرة تكاليفها.
- اختر Claude Fable 5 للعمل المستقل طويل الأمد: جلسات وكيل متعددة الساعات، مهام حيث تؤدي خطوة واحدة خاطئة إلى إضاعة ساعة من التقدم، وأعباء العمل التي تكافئ التكلفة-القدرة المعروضة في معامل الجهد.
- اختر GPT-5.6 Sol لوكلاء الترميز على نطاق المستودعات الذين يعملون عبر قواعد بيانات كبيرة موجودة بحد أدنى من الإشراف، وللفرق التي تريد أعمق نظام بيئي خارجي حول واجهة برمجة التطبيقات.
- اختر جهاز توجيه (router) إذا استطعت. النمط الذي تتفق عليه معظم فرق الإنتاج: نموذج افتراضي رخيص يتعامل مع الجزء الأكبر من حركة المرور، وتتصاعد أصعب 10% إلى نموذج رائد. أرقام إطلاق Gemini 3.7 Flash تجعله افتراضيًا موثوقًا به في هذه البنية، وهو ما لم يكن صحيحًا بالنسبة لـ 3.6 Flash.
اختبر جميع المزودين الثلاثة في مساحة عمل واحدة في Apidog
المقارنة المهمة هي تلك التي تجريها على مطالباتك الخاصة. يحتفظ Apidog بمجموعات لـ Google و Anthropic و OpenAI في مشروع واحد، لذا يستغرق الاختبار فترة بعد الظهر بدلاً من سباق سريع:
- أنشئ ثلاث بيئات، واحدة لكل مزود، تحمل كل منها عنوان URL الأساسي الخاص بها ورأس المصادقة:
x-goog-api-keyلـ Gemini،x-api-keyلـ Anthropic، ورمز حامل لـ OpenAI. يصبح تبديل المزودين قائمة منسدلة، وليس تغييرًا في الكود. - اجمع 20 مطالبة حقيقية من منتجك. قم بتضمين مطالبة نظامك، تعريفات أدواتك إذا كنت تستخدم استدعاء الوظائف، وخمس حالات صعبة معروفة على الأقل.
- أضف تأكيدات لما يهمك: صلاحية الاستجابة، عدد الرموز من كتلة الاستخدام لكل مزود، حدود زمن الاستجابة. لأعباء عمل استدعاء الأدوات، تأكد من أن JSON لاستدعاء الأداة يحلل ويتطابق مع مخططك؛ النماذج تفشل هناك في كثير من الأحيان أكثر مما تفشل في النثر.
- شغل كل مجموعة ثلاث مرات لكل نموذج. يختلف إخراج LLM؛ ثلاث عمليات تشغيل تكشف التباين الذي يخفيه عرض توضيحي واحد. قارن معدل النجاح والتكلفة لكل مهمة ناجحة.
- احتفظ بالمجموعة. تطلق النماذج الآن بفارق أسابيع؛ جاء 3.7 Flash بعد 3.6 بثلاثة أسابيع. الفرق التي لديها تسخير دائم تعيد اتخاذ القرار في فترة بعد الظهر بدلاً من الاعتماد على الحكايات.
الأسئلة الشائعة
هل Gemini 3.7 Flash أفضل من Claude أو GPT للبرمجة؟
ليس على المستوى الأعلى. سجل GPT-5.6 Sol Max نسبة 73.0% في DeepSWE v1.1 مقابل 65.3% لـ 3.7 Flash، ويتفوق Claude Fable 5 في الاتساق عبر معايير الترميز والوكلاء. ما تغير هو نسبة السعر إلى الأداء: يصل 3.7 Flash إلى نتائج كانت تعتبر متقدمة قبل أسابيع مع تكاليف تشغيل عادية.
ما مدى رخص Gemini 3.7 Flash مقارنة بـ Claude أو GPT؟
حتى 31 ديسمبر 2026، يكلف Gemini 3.7 Flash 0.75 دولار لكل مليون رمز إدخال و 3.75 دولار لكل مليون رمز إخراج. تفرض نماذج Claude و GPT الرائدة عدة أضعاف ذلك لكل رمز؛ تحقق من صفحات التسعير المباشرة قبل تقدير التكاليف. تذكر أن السعر التمهيدي يتضاعف في 1 يناير 2027.
هل يمكنني استدعاء Gemini 3.7 Flash عبر OpenAI SDK؟
تُظهر Google نقطة نهاية متوافقة مع OpenAI تتعامل مع شكل الدردشة الأساسي، لذا يعمل تبديل base_url للنصوص المدخلة والمخرجة. لكن أجزاء الوسائط المتعددة واستدعاءات الأدوات لا تتوافق بشكل نظيف، لذا استخدم مخطط contents الأصلي لأي شيء يتجاوز الدردشة العادية. يُظهر البرنامج التعليمي لاستدعاء الوظائف لـ Gemini 3.7 Flash تنسيق الأداة الأصلي من البداية إلى النهاية.
هل يدعم Gemini 3.7 Flash استخدام الكمبيوتر والبحث؟
نعم. يأتي مع استدعاء الوظائف، والبحث كأداة، واستخدام الكمبيوتر، بالإضافة إلى حواجز حماية CBRN وسلامة الإنترنت المحدثة. يمثل تحسن AutomationBench من 17.0% إلى 30.4% أقرب مؤشر منشور لمدى تحسن حلقة الوكيل.
أين يتوفر Gemini 3.7 Flash؟
يتوفر عبر Gemini API بمفتاح AI Studio، و Google AI Studio، وتطبيق Gemini، و Gemini Spark لمشتركي AI Pro و Ultra، و Google Antigravity، و Android Studio، و Gemini Enterprise، في أكثر من 160 دولة. يمكن لفرق GCP الإنتاجية استدعائه عبر Vertex AI باستخدام OAuth بدلاً من مفتاح API.
مكان 3.7 Flash في بنيتك
الاستنتاج الخاطئ من هذه المقارنة هو أن "Gemini لحق بالنماذج الرائدة". لم يحدث ذلك؛ لا يزال Sol يتفوق في عمق الترميز على مستوى المستودع ولا يزال Fable 5 يتفوق في الموثوقية طويلة الأمد. الاستنتاج الصحيح هو أن الحد الأدنى قد تغير: أسعار النماذج العاملة تشتري الآن درجات كانت تبرر أسعارًا متميزة قبل ربع عام، مما يعيد تعيين الإعدادات الافتراضية في أي بنية جهاز توجيه. تتعامل نماذج فئة Flash مع الجزء الأكبر، وتتعامل النماذج الرائدة مع التصعيدات.
القرار قابل للقياس، لذا قم بقياسه. قم بتوصيل جميع المزودين الثلاثة في مساحة عمل واحدة، وقم بتشغيل مطالباتك الحقيقية مع التأكيدات، ودع التكلفة لكل مهمة مكتملة تختار الفائز. قم بتنزيل Apidog مجانًا، وقم بإعداد البيئات الثلاثة، وسيكون لديك دليل على مستوى المزود قبل إغلاق نافذة التسعير التمهيدية.

