يتصدر Gemini 4 Argon جدول مقاييس جوجل في 13 من أصل 19 صفًا مقارنةً بـ GPT-6 Astra و Claude Opus 5.5 و Claude Fable 5.1، ولكن هناك حقيقة واحدة تفوق أي نتيجة: يمكنك شراء Astra و Opus 5.5 اليوم، ولا يمكنك شراء Argon. يتوفر نموذج جوجل الجديد اليوم فقط لمدافعي برنامج Fairwind، بسعر 2 دولار / 10 دولارات لكل مليون رمز خلال فترة تقديمية و 4 دولارات / 20 دولارًا بعد ذلك، وهو بالضبط ما يكلفه Opus 5.5.
تقارن هذه المقالة النماذج الأربعة من حيث السعر والقيود، وتجمع صفوف المقارنات حسب النموذج الفائز، وتشرح لماذا الأرقام ليست قابلة للمقارنة تمامًا، وتنتهي بدليل توجيهي وطريقة لاختبار جميع النماذج الثلاثة باستخدام طلباتك الخاصة في Apidog. هل أنت جديد على Argon؟ ابدأ بـ ما هو Gemini 4 Argon؛ لمعرفة التوقيت، راجع دليل تاريخ إصدار Argon.
السعر والحدود جنبًا إلى جنب
يتضمن جدول جوجل Claude Fable 5.1، لذا يحصل هو أيضًا على عمود. الأسعار لكل مليون رمز، من صفحة كل بائع: منشور إطلاق جوجل، صفحة نموذج GPT-6 Astra من OpenAI، و صفحة أسعار Anthropic.
| Gemini 4 Argon | GPT-6 Astra | Claude Opus 5.5 | Claude Fable 5.1 | |
|---|---|---|---|---|
| هل يمكنك الاتصال به اليوم؟ | لا، Fairwind فقط | نعم | نعم | نعم |
| معرف نموذج API | غير منشور | gpt-6-astra |
claude-opus-5-5 |
claude-fable-5-1 |
| الإدخال | 2 دولارًا للتقديم، ثم 4 دولارات | 10 دولارات | 4 دولارات | 10 دولارات |
| الإدخال المخزن مؤقتًا | 0.10 دولارًا للتقديم، ثم 0.20 دولارًا | 1 دولار | 0.20 دولارًا | 0.25 دولارًا |
| الإخراج | 10 دولارات للتقديم، ثم 20 دولارًا | 50 دولارًا | 20 دولارًا | 50 دولارًا |
| الحد الأقصى للإخراج | 1 مليون (حد جوجل المعلن) | 128 ألفًا | 128 ألفًا (300 ألف في Batch، بيتا) | 128 ألفًا |
| نافذة السياق | غير منشورة | 1,050,000 (922 ألف كحد أقصى للإدخال) | 1 مليون | 1 مليون |
| رسوم إضافية للمطالبات الطويلة | غير مذكورة | أكثر من 272 ألف إدخال: 2x الإدخال وذاكرة التخزين المؤقت، 1.5x الإخراج، على الطلب الكامل | لا يوجد | لا يوجد |
تبرز ثلاثة أمور. يتطابق السعر القياسي لـ Argon مع Opus 5.5 من حيث الإدخال والإدخال المخزن مؤقتًا والإخراج، لذا فإن ميزته السعرية على Anthropic تدوم فقط طوال فترة التقديم، ولم تحدد جوجل تاريخ انتهائها. يُسجل سعر Astra و Fable 5.1 بـ 2.5 ضعف أسعار الإدخال والإخراج القياسية لـ Argon و 5 أضعاف أسعاره التقديمية. ورقم الإخراج البالغ 1 مليون هو من جوجل: تدرج Vals AI حدًا أقصى للإخراج يبلغ 262 ألفًا لتكوين Argon الذي اختبرته. لحساب تكلفة كل طلب، راجع تسعير Gemini 4 Argon.
أين يتصدر كل نموذج في جدول جوجل
قبل الأرقام: هذا جدول جوجل. نتائج Argon هي ما أبلغت عنه جوجل، بعضها محسوب ذاتيًا وبعضها من لوحات الصدارة؛ معظم نتائج المنافسين هي أرقام البائعين أنفسهم أو نتائج لوحات الصدارة العامة، عند أقصى إعدادات استدلال متوفرة. تختلف الأدوات، لذا اقرأ الفجوات الصغيرة على أنها ضوضاء.
| الرائد | المعيار | Argon | Astra | Fable 5.1 | Opus 5.5 |
|---|---|---|---|---|---|
| Argon: العمل المعرفي | مؤشر Vals | 68.9% | 63.1% | 65.8% | 67.0% |
| Argon: العمل المعرفي | AutomationBench | 51.3% | 41.4% | 31.4% | 42.5% |
| Argon: العمل المعرفي | معيار وكيل هارفي القانوني | 19.6% | 5.4% | 6.7% | 3.8% |
| Argon: الترميز | DeepSWE v1.1 | 77.9% | 74.1% | 67.4% | 74.2% |
| Argon: سياق طويل | GraphWalks 256 ألف إلى 1 مليون (F1) | 84.2% | 71.8% | 65.0% | 66.8% |
| Argon: متعدد الوسائط | LVBench | 91.7% | 87.5% | 79.7% | 83.7% |
| Argon: متعدد الوسائط | Chartography | 71.6% | 71.0% | 46.2% | 66.3% |
| Astra | FrontierSWE v2 | 55.0% | 65.5% | 56.3% | 62.3% |
| Astra | Terminal-Bench Science 0.1 | 57.6% | 68.1% | 52.6% | 63.3% |
| Astra | OSWorld-2.0 (غير متصل، جزئي) | 69.2% | 72.6% | لم يبلغ عنها | لم يبلغ عنها |
| Opus 5.5 | Terminal-bench 4.0 | 57.4% | 58.2% | 57.9% | 66.4% |
| Opus 5.5 | PostTrainBench | 45.3% | 44.3% | 40.2% | 49.3% |
| تعادل | CWE-bench v1 | 68.0% | 68.0% | 58.0% | 67.0% |
انتصارات Argon الصريحة الأخرى هي Vals Finance Agent v2، Vibe Code Bench، LABBench 2، RiemannBench، GraphWalks حتى 128 ألف و Agent’s Last Exam. لا يتصدر Fable 5.1 أي صف. على CWE-bench v1، تظهر لوحة صدارة DeepMind للأمن السيبراني تعادلًا ثلاثيًا بنسبة 68% بين Argon و Astra و Grok 4.7، مع Opus 5.5 بنسبة 67%.
بخصوص Gemini 4 Argon مقابل Fable 5.1، يسجل Argon أعلى في 15 من أصل 17 صفًا حيث يبلغان عن رقم؛ يتفوق Fable عليه فقط في FrontierSWE v2 (56.3% مقابل 55.0%) و Terminal-bench 4.0 (57.9% مقابل 57.4%). توجد أرقام Anthropic الخاصة في منشورنا مقاييس Claude Fable 5.1، ويوجد الجدول الكامل المكون من 19 صفًا في مقاييس Gemini 4 Argon.
ثلاثة محاذير قبل أن تثق بالفجوات
أرقام المنافسين ليست من تشغيل جوجل. تقول منهجية جوجل أن النتائج للنماذج غير الجيميني "مأخوذة من الأرقام المبلغ عنها ذاتيًا من قبل الموردين ما لم يُذكر خلاف ذلك"، وتأتي عدة صفوف من لوحات صدارة عامة تديرها Vals AI، Proximal و Surge.
تختلف الأدوات. في DeepSWE v1.1، قامت جوجل بحساب نسبة 77.9% لـ Argon ذاتيًا باستخدام أداة mini-swe-agent، بينما تأتي نتيجة Astra من لوحة الصدارة العامة وتأتي نتائج Anthropic من بطاقات النظام. في LVBench، أخذ Gemini عينات فيديو بمعدل إطار واحد في الثانية، بينما حصل Astra على 800 إطار، و Opus 5.5 على 600، و Fable 5.1 على 300، "بسبب قيود API".
يسجل نفس النموذج درجات مختلفة عبر المخططات. يختلف رقم Terminal-bench 4.0 لـ Opus 5.5 بين المخططات اعتمادًا على الأداة وإعداد الجهد؛ تُبلغ Anthropic عن نسبة 66.4% عند جهد xhigh. لذا لا تخلط المصادر أبدًا في جدول واحد.
ماذا يقول المقيمون من طرف ثالث
تُضيِّق لوحات الصدارة المستقلة الفجوة. تُدرج Artificial Analysis Argon في المرتبة الثامنة من أصل 223، لكن تلك القائمة تحسب كل إعداد استدلال على حدة. حسب النموذج المميز، يتعادل Argon (53) مع GPT-6 Astra و Claude Fable 5.1 ويأتي خلف Claude Opus 5.5 (58 كحد أقصى) و Claude Sonnet 5.5 (56). تُدرج AA أيضًا معدل هلوسة Argon على AA-Omniscience بنسبة 15%، مقابل 51% لـ Astra في إعدادها الأقصى.
على Arena، يحتل Argon المرتبة الأولى في فئة النصوص بـ 1525، وهو مصنف مبدئيًا بناءً على 4,942 صوتًا، مع Opus 5.5 في المرتبة الرابعة. يصنفه Vals AI الأول من بين 41 نموذجًا في مؤشر Vals، وهو أول نموذج Gemini يتصدره.
لا يقتنع الجميع داخل جوجل: ذكرت بلومبرج أن بعض الموظفين الذين لديهم وصول يقولون إن Argon مخيب للآمال في بعض أعمال الترميز وتصميم الواجهة الأمامية مقارنة بمقاييسه، وهو وصف وصفته جوجل بأنه غير دقيق.
أي نموذج يجب توجيه العمل إليه
لا يوجد نموذج رائد واحد هو الأفضل في عام 2026. قم بتوجيه العمل حسب المهمة، واحتفظ بعمود Argon لليوم الذي يتم فيه إطلاقه:
| المهمة | التوجيه اليوم | عند إطلاق Argon |
|---|---|---|
| وكلاء الشؤون القانونية والمالية وأتمتة المكاتب | Opus 5.5 (مؤشر Vals 67.0%) | اختبر Argon: فهو يتصدر جميع صفوف العمل المعرفي الأربعة |
| وكلاء الترميز المعتمدون على الطرفيات بكثافة | Opus 5.5 (Terminal-bench 4.0 بنسبة 66.4%) | لا يزال Opus 5.5 متصدرًا |
| هندسة البرمجيات القائمة على الوكلاء | Astra (FrontierSWE v2 بنسبة 65.5%) أو Opus 5.5 | يتصدر Argon في DeepSWE لكنه يتخلف في FrontierSWE؛ اختبر كلاهما |
| وكلاء استخدام الكمبيوتر وواجهة المستخدم الرسومية | Astra (OSWorld-2.0 بنسبة 72.6%) | يتصدر Astra في OSWorld؛ يتصدر Argon في Agent’s Last Exam |
| الاستدلال على المطالبات التي تزيد عن 256 ألف رمز | Opus 5.5 (لا توجد رسوم إضافية) أو Astra (رسوم إضافية فوق 272 ألفًا) | Argon (GraphWalks 256 ألف إلى 1 مليون بنسبة 84.2%) |
| فهم الفيديو والرسوم البيانية | Astra (LVBench بنسبة 87.5%) | Argon (91.7%)، مع التحفظ على عدد الإطارات |
| العلوم وهندسة تعلم الآلة | Astra (Terminal-Bench Science)، Opus 5.5 (PostTrainBench) | يتصدر Argon في LABBench 2 و RiemannBench؛ اختبره |
| استجابات فردية تتجاوز 128 ألف رمز | Opus 5.5 على Batch (300 ألف، بيتا) | Argon، حتى 1 مليون المذكورة من جوجل |
| العمل عالي الحجم والحساس للتكلفة | Opus 5.5 (4 دولارات / 20 دولارًا) | Argon بسعر 2 دولار / 10 دولارات طالما استمرت فترة التقديم |
إذا كان السعر أهم من أعلى النتائج، فإن مقارنتنا GPT-6 Sol vs Claude Opus 5.5 تغطي خط Sol الأرخص من OpenAI مقابل Opus.
قارن النماذج الثلاثة باستخدام طلباتك الخاصة
لا يمكن لجداول البائعين أن تخبرك كيف يتعامل كل نموذج مع طلباتك. يمكن لتقييم صغير في Apidog أن يفعل ذلك، ويمكنك إنشاؤه اليوم.
- أنشئ مشروعًا واحدًا بثلاثة طلبات: GPT-6 Astra، Claude Opus 5.5، وطلب Gemini يكون حقل النموذج فيه
{{GEMINI_MODEL}}، مضبوطًا علىgemini-3.8-flashحتى تنشر جوجل معرف Argon. يغطي دليل GPT-6 Astra API الخاص بنا و ما هو Claude Opus 5.5 تنسيق طلب كل بائع. - اخزن مفتاح API لكل بائع كمتغير بيئة، وضع الطلب في متغير مشترك واحد بحيث تحصل جميع الطلبات الثلاثة على نفس الإدخال.
- أضف تأكيدات: الحالة 200، إجابة غير فارغة، رموز إخراج تحت سقف، وتكلفة محسوبة تحت ميزانيتك بأسعار كل بائع المنشورة.
- شغّل الثلاثة كسيناريو اختبار واحد وقارن نتائج كل طلب في تقرير الاختبار.
تأكيد التكلفة هو عملية حسابية بسيطة. لطلب يتكون من 20,000 رمز إدخال و 4,000 رمز إخراج، يكلف Astra 20,000 × 10 دولارات / 1 مليون + 4,000 × 50 دولارًا / 1 مليون = 0.20 دولارًا + 0.20 دولارًا = 0.40 دولارًا. يكلف Opus 5.5 0.08 دولارًا + 0.08 دولارًا = 0.16 دولارًا. سيكلف Argon 0.08 دولارًا بأسعار التقديم و 0.16 دولارًا بأسعارها القياسية. ومع ذلك، فإن سعر الرمز الواحد ليس هو تكلفة المهمة الواحدة: فقد قدرت Artificial Analysis Argon بحوالي 62 ألف رمز إخراج لكل مهمة مقابل حوالي 27 ألفًا لـ Astra بأقصى جهد، لذا قم بقياس رموز الإخراج على طلباتك الخاصة.
عندما يتم شحن Argon، قم بتغيير GEMINI_MODEL، أعد تشغيل السيناريو، وسيكون لديك مقارنة بنفس الطلب مقابل النموذجين اللذين يمكنك شراءهما الآن.
الأسئلة الشائعة
هل Gemini 4 Argon أفضل من GPT-6 Astra؟ يتعادلان بنتيجة 53 في Artificial Analysis. في جدول جوجل، يسجل Argon أعلى في معظم الصفوف، لكن Astra يفوز في FrontierSWE v2 و Terminal-Bench Science 0.1 و OSWorld-2.0، و Astra هو الذي يمكنك الاتصال به اليوم.
Gemini 4 Argon مقابل Claude Opus 5.5: أيهما أفضل؟ جدول جوجل يفضل Argon في معظم الصفوف؛ يفوز Opus 5.5 في Terminal-bench 4.0 و PostTrainBench ويتصدر Artificial Analysis بنتيجة 58 مقابل 53. بأسعارها القياسية، يكلفان نفس الشيء.
هل Gemini 4 Argon أرخص من Claude Opus 5.5؟ خلال فترة التقديم، هو بنصف السعر (2 دولار / 10 دولارات مقابل 4 دولارات / 20 دولارًا). بعد ذلك، تكون الأسعار المعلنة متطابقة، ولم تحدد جوجل متى تنتهي فترة التقديم.
أي نموذج لديه أكبر حد إخراج؟ Argon، بحد معلن قدره 1 مليون رمز، على الرغم من أن Vals AI يدرج 262 ألفًا للتكوين الذي اختبره. أما البقية فيحددون الإخراج المتزامن بـ 128 ألفًا. يغطي دليلنا الخاص بـ 1 مليون رمز إخراج ما يعنيه ذلك لعميلك.
هل يمكنني استخدام Gemini 4 Argon اليوم؟ فقط من خلال برنامج Fairwind من جوجل، لمجموعة من شركاء الدفاع السيبراني الموثوقين. يأتي عملاء API المدفوعون ومشتركو Google AI Ultra بعد ذلك، بدون تحديد تاريخ.
اختر حسب عبء العمل، ثم اختبر
يبدو Argon الأقوى في العمل المعرفي، والسياق الطويل، والصفوف متعددة الوسائط؛ Astra في FrontierSWE، و Terminal-Bench Science، و OSWorld؛ Opus 5.5 في العمل الطرفي وهندسة تعلم الآلة، بنفس السعر الذي سيفرضه Argon بعد فترة تقديمه. ابدأ بالنموذجين اللذين يمكنك شراءهما الآن، واحتفظ بنموذج Gemini في متغير، وأعد تشغيل السيناريو الخاص بك في اليوم الذي يُفتح فيه Argon. لإعداد مقارنة الطلبات الثلاثة في مشروع واحد، قم بتنزيل Apidog.
