جمناي 4 أرجون مقابل جي بي تي 6 أسترا مقابل كلود أوبوس 5.5

جيميني 4 أرجون مقابل جي بي تي-6 أسترا مقابل كلود أوبوس 5.5: السعر، حدود الإخراج، أين يتصدر كل منها جدول جوجل للمعايير، وأي منها يجب استخدامه اليوم.

Ashley Innocent

Ashley Innocent

2 أكتوبر 2026

جمناي 4 أرجون مقابل جي بي تي 6 أسترا مقابل كلود أوبوس 5.5

Apidog للمؤسسات

النشر على الخوادم المحلية

SSO و RBAC

متوافق مع SOC 2

استكشف Apidog للمؤسسات

يتصدر Gemini 4 Argon جدول مقاييس جوجل في 13 من أصل 19 صفًا مقارنةً بـ GPT-6 Astra و Claude Opus 5.5 و Claude Fable 5.1، ولكن هناك حقيقة واحدة تفوق أي نتيجة: يمكنك شراء Astra و Opus 5.5 اليوم، ولا يمكنك شراء Argon. يتوفر نموذج جوجل الجديد اليوم فقط لمدافعي برنامج Fairwind، بسعر 2 دولار / 10 دولارات لكل مليون رمز خلال فترة تقديمية و 4 دولارات / 20 دولارًا بعد ذلك، وهو بالضبط ما يكلفه Opus 5.5.

تقارن هذه المقالة النماذج الأربعة من حيث السعر والقيود، وتجمع صفوف المقارنات حسب النموذج الفائز، وتشرح لماذا الأرقام ليست قابلة للمقارنة تمامًا، وتنتهي بدليل توجيهي وطريقة لاختبار جميع النماذج الثلاثة باستخدام طلباتك الخاصة في Apidog. هل أنت جديد على Argon؟ ابدأ بـ ما هو Gemini 4 Argon؛ لمعرفة التوقيت، راجع دليل تاريخ إصدار Argon.

زر

السعر والحدود جنبًا إلى جنب

يتضمن جدول جوجل Claude Fable 5.1، لذا يحصل هو أيضًا على عمود. الأسعار لكل مليون رمز، من صفحة كل بائع: منشور إطلاق جوجل، صفحة نموذج GPT-6 Astra من OpenAI، و صفحة أسعار Anthropic.

Gemini 4 Argon GPT-6 Astra Claude Opus 5.5 Claude Fable 5.1
هل يمكنك الاتصال به اليوم؟ لا، Fairwind فقط نعم نعم نعم
معرف نموذج API غير منشور gpt-6-astra claude-opus-5-5 claude-fable-5-1
الإدخال 2 دولارًا للتقديم، ثم 4 دولارات 10 دولارات 4 دولارات 10 دولارات
الإدخال المخزن مؤقتًا 0.10 دولارًا للتقديم، ثم 0.20 دولارًا 1 دولار 0.20 دولارًا 0.25 دولارًا
الإخراج 10 دولارات للتقديم، ثم 20 دولارًا 50 دولارًا 20 دولارًا 50 دولارًا
الحد الأقصى للإخراج 1 مليون (حد جوجل المعلن) 128 ألفًا 128 ألفًا (300 ألف في Batch، بيتا) 128 ألفًا
نافذة السياق غير منشورة 1,050,000 (922 ألف كحد أقصى للإدخال) 1 مليون 1 مليون
رسوم إضافية للمطالبات الطويلة غير مذكورة أكثر من 272 ألف إدخال: 2x الإدخال وذاكرة التخزين المؤقت، 1.5x الإخراج، على الطلب الكامل لا يوجد لا يوجد

تبرز ثلاثة أمور. يتطابق السعر القياسي لـ Argon مع Opus 5.5 من حيث الإدخال والإدخال المخزن مؤقتًا والإخراج، لذا فإن ميزته السعرية على Anthropic تدوم فقط طوال فترة التقديم، ولم تحدد جوجل تاريخ انتهائها. يُسجل سعر Astra و Fable 5.1 بـ 2.5 ضعف أسعار الإدخال والإخراج القياسية لـ Argon و 5 أضعاف أسعاره التقديمية. ورقم الإخراج البالغ 1 مليون هو من جوجل: تدرج Vals AI حدًا أقصى للإخراج يبلغ 262 ألفًا لتكوين Argon الذي اختبرته. لحساب تكلفة كل طلب، راجع تسعير Gemini 4 Argon.

أين يتصدر كل نموذج في جدول جوجل

قبل الأرقام: هذا جدول جوجل. نتائج Argon هي ما أبلغت عنه جوجل، بعضها محسوب ذاتيًا وبعضها من لوحات الصدارة؛ معظم نتائج المنافسين هي أرقام البائعين أنفسهم أو نتائج لوحات الصدارة العامة، عند أقصى إعدادات استدلال متوفرة. تختلف الأدوات، لذا اقرأ الفجوات الصغيرة على أنها ضوضاء.

الرائد المعيار Argon Astra Fable 5.1 Opus 5.5
Argon: العمل المعرفي مؤشر Vals 68.9% 63.1% 65.8% 67.0%
Argon: العمل المعرفي AutomationBench 51.3% 41.4% 31.4% 42.5%
Argon: العمل المعرفي معيار وكيل هارفي القانوني 19.6% 5.4% 6.7% 3.8%
Argon: الترميز DeepSWE v1.1 77.9% 74.1% 67.4% 74.2%
Argon: سياق طويل GraphWalks 256 ألف إلى 1 مليون (F1) 84.2% 71.8% 65.0% 66.8%
Argon: متعدد الوسائط LVBench 91.7% 87.5% 79.7% 83.7%
Argon: متعدد الوسائط Chartography 71.6% 71.0% 46.2% 66.3%
Astra FrontierSWE v2 55.0% 65.5% 56.3% 62.3%
Astra Terminal-Bench Science 0.1 57.6% 68.1% 52.6% 63.3%
Astra OSWorld-2.0 (غير متصل، جزئي) 69.2% 72.6% لم يبلغ عنها لم يبلغ عنها
Opus 5.5 Terminal-bench 4.0 57.4% 58.2% 57.9% 66.4%
Opus 5.5 PostTrainBench 45.3% 44.3% 40.2% 49.3%
تعادل CWE-bench v1 68.0% 68.0% 58.0% 67.0%

انتصارات Argon الصريحة الأخرى هي Vals Finance Agent v2، Vibe Code Bench، LABBench 2، RiemannBench، GraphWalks حتى 128 ألف و Agent’s Last Exam. لا يتصدر Fable 5.1 أي صف. على CWE-bench v1، تظهر لوحة صدارة DeepMind للأمن السيبراني تعادلًا ثلاثيًا بنسبة 68% بين Argon و Astra و Grok 4.7، مع Opus 5.5 بنسبة 67%.

بخصوص Gemini 4 Argon مقابل Fable 5.1، يسجل Argon أعلى في 15 من أصل 17 صفًا حيث يبلغان عن رقم؛ يتفوق Fable عليه فقط في FrontierSWE v2 (56.3% مقابل 55.0%) و Terminal-bench 4.0 (57.9% مقابل 57.4%). توجد أرقام Anthropic الخاصة في منشورنا مقاييس Claude Fable 5.1، ويوجد الجدول الكامل المكون من 19 صفًا في مقاييس Gemini 4 Argon.

ثلاثة محاذير قبل أن تثق بالفجوات

أرقام المنافسين ليست من تشغيل جوجل. تقول منهجية جوجل أن النتائج للنماذج غير الجيميني "مأخوذة من الأرقام المبلغ عنها ذاتيًا من قبل الموردين ما لم يُذكر خلاف ذلك"، وتأتي عدة صفوف من لوحات صدارة عامة تديرها Vals AI، Proximal و Surge.

تختلف الأدوات. في DeepSWE v1.1، قامت جوجل بحساب نسبة 77.9% لـ Argon ذاتيًا باستخدام أداة mini-swe-agent، بينما تأتي نتيجة Astra من لوحة الصدارة العامة وتأتي نتائج Anthropic من بطاقات النظام. في LVBench، أخذ Gemini عينات فيديو بمعدل إطار واحد في الثانية، بينما حصل Astra على 800 إطار، و Opus 5.5 على 600، و Fable 5.1 على 300، "بسبب قيود API".

يسجل نفس النموذج درجات مختلفة عبر المخططات. يختلف رقم Terminal-bench 4.0 لـ Opus 5.5 بين المخططات اعتمادًا على الأداة وإعداد الجهد؛ تُبلغ Anthropic عن نسبة 66.4% عند جهد xhigh. لذا لا تخلط المصادر أبدًا في جدول واحد.

ماذا يقول المقيمون من طرف ثالث

تُضيِّق لوحات الصدارة المستقلة الفجوة. تُدرج Artificial Analysis Argon في المرتبة الثامنة من أصل 223، لكن تلك القائمة تحسب كل إعداد استدلال على حدة. حسب النموذج المميز، يتعادل Argon (53) مع GPT-6 Astra و Claude Fable 5.1 ويأتي خلف Claude Opus 5.5 (58 كحد أقصى) و Claude Sonnet 5.5 (56). تُدرج AA أيضًا معدل هلوسة Argon على AA-Omniscience بنسبة 15%، مقابل 51% لـ Astra في إعدادها الأقصى.

على Arena، يحتل Argon المرتبة الأولى في فئة النصوص بـ 1525، وهو مصنف مبدئيًا بناءً على 4,942 صوتًا، مع Opus 5.5 في المرتبة الرابعة. يصنفه Vals AI الأول من بين 41 نموذجًا في مؤشر Vals، وهو أول نموذج Gemini يتصدره.

لا يقتنع الجميع داخل جوجل: ذكرت بلومبرج أن بعض الموظفين الذين لديهم وصول يقولون إن Argon مخيب للآمال في بعض أعمال الترميز وتصميم الواجهة الأمامية مقارنة بمقاييسه، وهو وصف وصفته جوجل بأنه غير دقيق.

أي نموذج يجب توجيه العمل إليه

لا يوجد نموذج رائد واحد هو الأفضل في عام 2026. قم بتوجيه العمل حسب المهمة، واحتفظ بعمود Argon لليوم الذي يتم فيه إطلاقه:

المهمة التوجيه اليوم عند إطلاق Argon
وكلاء الشؤون القانونية والمالية وأتمتة المكاتب Opus 5.5 (مؤشر Vals 67.0%) اختبر Argon: فهو يتصدر جميع صفوف العمل المعرفي الأربعة
وكلاء الترميز المعتمدون على الطرفيات بكثافة Opus 5.5 (Terminal-bench 4.0 بنسبة 66.4%) لا يزال Opus 5.5 متصدرًا
هندسة البرمجيات القائمة على الوكلاء Astra (FrontierSWE v2 بنسبة 65.5%) أو Opus 5.5 يتصدر Argon في DeepSWE لكنه يتخلف في FrontierSWE؛ اختبر كلاهما
وكلاء استخدام الكمبيوتر وواجهة المستخدم الرسومية Astra (OSWorld-2.0 بنسبة 72.6%) يتصدر Astra في OSWorld؛ يتصدر Argon في Agent’s Last Exam
الاستدلال على المطالبات التي تزيد عن 256 ألف رمز Opus 5.5 (لا توجد رسوم إضافية) أو Astra (رسوم إضافية فوق 272 ألفًا) Argon (GraphWalks 256 ألف إلى 1 مليون بنسبة 84.2%)
فهم الفيديو والرسوم البيانية Astra (LVBench بنسبة 87.5%) Argon (91.7%)، مع التحفظ على عدد الإطارات
العلوم وهندسة تعلم الآلة Astra (Terminal-Bench Science)، Opus 5.5 (PostTrainBench) يتصدر Argon في LABBench 2 و RiemannBench؛ اختبره
استجابات فردية تتجاوز 128 ألف رمز Opus 5.5 على Batch (300 ألف، بيتا) Argon، حتى 1 مليون المذكورة من جوجل
العمل عالي الحجم والحساس للتكلفة Opus 5.5 (4 دولارات / 20 دولارًا) Argon بسعر 2 دولار / 10 دولارات طالما استمرت فترة التقديم

إذا كان السعر أهم من أعلى النتائج، فإن مقارنتنا GPT-6 Sol vs Claude Opus 5.5 تغطي خط Sol الأرخص من OpenAI مقابل Opus.

قارن النماذج الثلاثة باستخدام طلباتك الخاصة

لا يمكن لجداول البائعين أن تخبرك كيف يتعامل كل نموذج مع طلباتك. يمكن لتقييم صغير في Apidog أن يفعل ذلك، ويمكنك إنشاؤه اليوم.

  1. أنشئ مشروعًا واحدًا بثلاثة طلبات: GPT-6 Astra، Claude Opus 5.5، وطلب Gemini يكون حقل النموذج فيه {{GEMINI_MODEL}}، مضبوطًا على gemini-3.8-flash حتى تنشر جوجل معرف Argon. يغطي دليل GPT-6 Astra API الخاص بنا و ما هو Claude Opus 5.5 تنسيق طلب كل بائع.
  2. اخزن مفتاح API لكل بائع كمتغير بيئة، وضع الطلب في متغير مشترك واحد بحيث تحصل جميع الطلبات الثلاثة على نفس الإدخال.
  3. أضف تأكيدات: الحالة 200، إجابة غير فارغة، رموز إخراج تحت سقف، وتكلفة محسوبة تحت ميزانيتك بأسعار كل بائع المنشورة.
  4. شغّل الثلاثة كسيناريو اختبار واحد وقارن نتائج كل طلب في تقرير الاختبار.

تأكيد التكلفة هو عملية حسابية بسيطة. لطلب يتكون من 20,000 رمز إدخال و 4,000 رمز إخراج، يكلف Astra 20,000 × 10 دولارات / 1 مليون + 4,000 × 50 دولارًا / 1 مليون = 0.20 دولارًا + 0.20 دولارًا = 0.40 دولارًا. يكلف Opus 5.5 0.08 دولارًا + 0.08 دولارًا = 0.16 دولارًا. سيكلف Argon 0.08 دولارًا بأسعار التقديم و 0.16 دولارًا بأسعارها القياسية. ومع ذلك، فإن سعر الرمز الواحد ليس هو تكلفة المهمة الواحدة: فقد قدرت Artificial Analysis Argon بحوالي 62 ألف رمز إخراج لكل مهمة مقابل حوالي 27 ألفًا لـ Astra بأقصى جهد، لذا قم بقياس رموز الإخراج على طلباتك الخاصة.

عندما يتم شحن Argon، قم بتغيير GEMINI_MODEL، أعد تشغيل السيناريو، وسيكون لديك مقارنة بنفس الطلب مقابل النموذجين اللذين يمكنك شراءهما الآن.

الأسئلة الشائعة

هل Gemini 4 Argon أفضل من GPT-6 Astra؟ يتعادلان بنتيجة 53 في Artificial Analysis. في جدول جوجل، يسجل Argon أعلى في معظم الصفوف، لكن Astra يفوز في FrontierSWE v2 و Terminal-Bench Science 0.1 و OSWorld-2.0، و Astra هو الذي يمكنك الاتصال به اليوم.

Gemini 4 Argon مقابل Claude Opus 5.5: أيهما أفضل؟ جدول جوجل يفضل Argon في معظم الصفوف؛ يفوز Opus 5.5 في Terminal-bench 4.0 و PostTrainBench ويتصدر Artificial Analysis بنتيجة 58 مقابل 53. بأسعارها القياسية، يكلفان نفس الشيء.

هل Gemini 4 Argon أرخص من Claude Opus 5.5؟ خلال فترة التقديم، هو بنصف السعر (2 دولار / 10 دولارات مقابل 4 دولارات / 20 دولارًا). بعد ذلك، تكون الأسعار المعلنة متطابقة، ولم تحدد جوجل متى تنتهي فترة التقديم.

أي نموذج لديه أكبر حد إخراج؟ Argon، بحد معلن قدره 1 مليون رمز، على الرغم من أن Vals AI يدرج 262 ألفًا للتكوين الذي اختبره. أما البقية فيحددون الإخراج المتزامن بـ 128 ألفًا. يغطي دليلنا الخاص بـ 1 مليون رمز إخراج ما يعنيه ذلك لعميلك.

هل يمكنني استخدام Gemini 4 Argon اليوم؟ فقط من خلال برنامج Fairwind من جوجل، لمجموعة من شركاء الدفاع السيبراني الموثوقين. يأتي عملاء API المدفوعون ومشتركو Google AI Ultra بعد ذلك، بدون تحديد تاريخ.

اختر حسب عبء العمل، ثم اختبر

يبدو Argon الأقوى في العمل المعرفي، والسياق الطويل، والصفوف متعددة الوسائط؛ Astra في FrontierSWE، و Terminal-Bench Science، و OSWorld؛ Opus 5.5 في العمل الطرفي وهندسة تعلم الآلة، بنفس السعر الذي سيفرضه Argon بعد فترة تقديمه. ابدأ بالنموذجين اللذين يمكنك شراءهما الآن، واحتفظ بنموذج Gemini في متغير، وأعد تشغيل السيناريو الخاص بك في اليوم الذي يُفتح فيه Argon. لإعداد مقارنة الطلبات الثلاثة في مشروع واحد، قم بتنزيل Apidog.

زر

ممارسة تصميم API في Apidog

اكتشف طريقة أسهل لبناء واستخدام واجهات برمجة التطبيقات