هذه هي النماذج المتقدمة الثلاثة التي على الأرجح تختار بينها في منتصف 2026: Claude Fable 5 من Anthropic، وGPT-5.5 من OpenAI، وGemini 3.1 Pro من Google. وصلت متقاربة، وكلها تحمل سعة سياق قرابة المليون رمز، وتجلس عند ثلاث نقاط سعرية مختلفة جداً.
الصعوبة ليست في تحديد أقوى نموذج نظرياً، بل في أن المزوّدين الثلاثة نشروا كميات متفاوتة جداً من الأدلة، حتى صار التقابل المباشر على المعايير غير ممكن أصلاً. هذا المقال يضع أمامك ما كشفه كل مزوّد فعلاً، وينبّهك على الجدول الوحيد الذي يجب ألا تأخذه على ظاهره، ويعطيك توصية لكل حالة استخدام.
ابدأ بصورة الميدان. Gemini 3.1 Pro هو الأرخص بفارق كبير والوحيد من الثلاثة بورقة معايير عامة كاملة. Fable 5 هو الأغلى والأوضح توجهاً نحو العمل الوكيلي طويل المدى، لكن أرقام إطلاقه تحمل علامة استفهام سنصل إليها. أما GPT-5.5 فهو الوسط المُحرِج: متوسط السعر، واسع القدرة بحسب السمعة، وشبه موثَّق على المعايير التي تهم لترتيبه أمام الآخرين.
السعر: الفجوة ضخمة
تظهر الفروق بوضوح في السعر. يكلف Gemini 3.1 Pro دولارين لكل مليون رمز إدخال و12 دولاراً للإخراج حتى 200K رمز، ثم يرتفع إلى 4 و18 دولاراً فوق هذه العتبة، مع احتساب رموز التفكير ضمن الإخراج. ويكلف GPT-5.5 خمسة دولارات للإدخال و30 دولاراً للإخراج، مع قراءة مخزنة مؤقتاً بسعر $0.50.
Claude Fable 5 هو الأغلى بسعر 10 دولارات للإدخال و50 دولاراً للإخراج. لكن خصم التخزين المؤقت البالغ 90% يخفض الإدخال المخزن إلى دولار واحد لكل مليون رمز، وهو فرق مهم لمسارات الوكلاء التي تعيد قراءة السياق نفسه في كل دورة.
هناك تفصيلان سعريان يسهل تفويتهما. سعة سياق GPT-5.5 ليست مليوناً مدوّراً، بل 1,050,000 رمز، وأي جلسة تتجاوز 272K رمز إدخال تحمل رسماً إضافياً: ضعف على الإدخال ومرة ونصف على الإخراج. وتسعير Gemini المُدرَّج ينقلب عند 200K، فالمهمة طويلة السياق على Gemini تُسعَّر بشكل مختلف تماماً عن القصيرة. اقرأ الشريحة التي ستقع فيها فعلاً، لا السعر المعلن في العنوان.
| المواصفة | Claude Fable 5 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|
| سعر الإدخال (لكل مليون) | $10 ($1 إصابة كاش) | $5 ($0.50 إصابة كاش) | $2 حتى 200K، و$4 فوقها |
| سعر الإخراج (لكل مليون) | $50 | $30 | $12 حتى 200K، و$18 فوقها |
| سعة السياق | مليون رمز | 1,050,000 رمز | مليون رمز |
| أقصى إخراج | 128K رمز | 128K رمز | 64K رمز |
| أبرز معيار منشور | SWE-bench Pro 80.3 (انظر التنبيه) | HealthBench 56.5 | SWE-bench Verified 80.6 |
| التوفر | متاح عموماً؛ تُحتسب أرصدة الخطة | API مدفوع | معاينة؛ تطبق شروط المزود |
المعايير: مزوّد واحد فقط أعطاك ورقة كاملة
هنا تخرج المقارنة عن المألوف، لأن المزوّدين الثلاثة نشروا كميات متباينة جذرياً. Gemini 3.1 Pro هو الموثَّق. نشرت Google نتائج ARC-AGI-2 عند 77.1، وGPQA Diamond عند 94.3، وHumanity's Last Exam مع الأدوات عند 51.4، وMMMU-Pro عند 80.5، وSWE-bench Verified عند 80.6، وMMMLU عند 92.6. ورقة واسعة تغطي الاستدلال والعلوم والوسائط المتعددة والبرمجة، ولهذا هو النموذج الوحيد هنا الذي تستطيع فعلاً وضعه على لوحة ترتيب.
نشرت Anthropic نتيجة SWE-bench Pro عند 80.3 لـFable 5. لكن جدولها يسجل الأعلى بين Mythos 5 وFable 5 في بعض الصفوف؛ فالصفوف المعلّمة للسيبراني والأحياء وبعض الاستدلال تخص Mythos 5 المقيد. والطلب الذي تصنفه منظومة Fable أمنياً يعود برفض صريح؛ لا تحدث محاولة على نموذج آخر إلا إذا ضبطها المطور أو المنتج. كما لم تنشر Anthropic SWE-bench Verified أو GPQA لـFable 5 عند الإطلاق، فلا توجد نتيجة برمجة أو علوم مشتركة نظيفة تقابل Gemini.
GPT-5.5 هو الذي ببساطة لا تستطيع ترتيبه. معايير OpenAI الرسمية الوحيدة للنموذج الرئيسي هي HealthBench 56.5 (المعدّل حسب الطول) وHealthBench Professional 51.8. لم تنشر SWE-bench ولا Terminal-Bench ولا OSWorld. لا يوجد معيار برمجة أو استدلال مشترك بين GPT-5.5 والآخرين، فأي ترتيب ورقي أمام Fable 5 أو Gemini 3.1 Pro سيكون مُختلَقاً. ولن نختلق واحداً. إن كان رقم برمجة أو استدلال لـGPT-5.5 مهماً لقرارك، فالجواب الصادق أن OpenAI لم تنشره.
السياق والحدود: متقارب، لا متطابق
الثلاثة كلها نماذج بسعة قرابة المليون رمز، وهو ما كان قبل عام هو العنوان وصار اليوم الحد الأدنى. Fable 5 وGemini 3.1 Pro يذكران مليون رمز سياقاً. وGPT-5.5 يتفوق قليلاً عند 1,050,000، رغم أنك كما ذُكر تدفع رسماً إضافياً بعد 272K رمز إدخال. الفارق العملي الأكبر في الإخراج: Fable 5 وGPT-5.5 يحدّان عند 128K رمز إخراج، بينما يحدّ Gemini 3.1 Pro عند 64K. إن كانت مهمتك توليد ردود مفردة طويلة جداً، فسقف Gemini نصف الآخرين، وقد يجبرك ذلك على تقطيع عمل ينجزه الآخران دفعة واحدة.
حدّ آخر يستحق أن يترسّخ عندك: Gemini 3.1 Pro يدمج رموز التفكير في سعر الإخراج. فالاستدعاء كثيف الاستدلال على Gemini يُحتسب تفكيره على سعر الإخراج ذاك، ما يجعل رقم الإخراج "الرخيص" أقل رخصاً على الاستدلال الصعب مما يبدو أولاً. يبقى الأرخص بين الثلاثة، لكنه ليس رخيصاً كما يوحي السعر المعلن متى فكّر النموذج بعمق.
التوفر: تطبق الشروط الحالية لكل مزود
عاد Claude Fable 5 إلى الإتاحة العالمية العامة. انتهى في 7 يوليو 2026 عرض مؤقت كان يضم استخدامه إلى حدود خطط Claude المدفوعة، ويُحتسب الاستخدام الحالي من أرصدة الخطة. في API يعيد الطلب المصنّف أمنياً رفضاً صريحاً؛ وإن أردت المحاولة على نموذج آخر فعليك إعداد ذلك في تطبيقك واحتساب سعر النموذج البديل.
GPT-5.5 وصول مدفوع مباشر عبر API. لكن انتبه للتسمية: النموذج الرئيسي GPT-5.5 أُعلن في 23 أبريل 2026، وهو متمايز عن "GPT-5.5 Instant" الذي صار افتراضي ChatGPT منذ 5 مايو 2026. ليسا النموذج نفسه، وإن كنت تختبر المعايير فتأكد أنك تستدعي النموذج الرئيسي. أما Gemini 3.1 Pro فليس له طبقة API مجانية إطلاقاً، بل تجربة عبر واجهة AI Studio فقط، وما زال رسمياً في مرحلة معاينة، صدر في 19 فبراير 2026، فقد تتغير أسعاره وحدوده.
أي نموذج لأي عمل
للعمل اليومي حيث تهم التكلفة والقدرة الواسعة معاً، اجعل Gemini 3.1 Pro الافتراضي. هو الأرخص بفارق كبير، ولديه ورقة المعايير الكاملة الوحيدة، وSWE-bench Verified 80.6 يعني أنك لا تضحّي بقدرة مقيسة كبيرة مقابل التوفير. الأمران اللذان تنتبه لهما: سقف الإخراج 64K واحتساب رموز التفكير ضمن الإخراج على الاستدلال الصعب. لمعظم الفرق هذا هو الافتراضي المنطقي، ومراجعة Gemini 3.1 Pro الكاملة تتعمق أكثر في مواضع ضعفه.
للهندسة الوكيلية الصعبة طويلة المدى حين تكون الميزانية ثانوية، اختبر Claude Fable 5 على مجموعة قبول تخص عملك. قد يخفض تخزين السياق تكلفة الإدخال المتكرر، لكن العرض انتهى وتطبق الأرصدة المعتادة. وبعض صفوف السيبراني والأحياء المعلّمة تخص Mythos 5؛ أما طلب Fable المصنّف أمنياً فيعود برفض ما لم يضبط تطبيقك محاولة بديلة صراحة. وتفصيل إطلاق Fable 5 يشرح الفرق.
GPT-5.5 هو الأصعب في بناء حجة نظيفة له على الورق، لمجرد أن OpenAI أعطتك القليل جداً لتبني عليه. إن كنت أصلاً تبني على منظومة OpenAI فـGPT-5.5 ترقية معقولة متوسطة السعر، وأرقام HealthBench عنده قوية فعلاً للعمل القريب من المجال الصحي. لكن إن كنت تختار من جديد وتريد الترتيب بالأدلة، فيصعب ترشيحه على Gemini الذي نشر كل شيء، أو على Fable 5 الذي نشر على الأقل درجة برمجته الوكيلية. ومراجعة GPT-5.5 تغطي ما تشتريه الترقية فوق GPT-5.
الخلاصة في سطر: Gemini 3.1 Pro للقيمة والشمول، وClaude Fable 5 للعمل الوكيلي المتميّز مع قراءة التنبيه، وGPT-5.5 فقط إن كانت منظومة OpenAI أو قوته في HealthBench هي سببك أصلاً. لا أحد من الثلاثة هو الفائز البديهي على كل محور، وهذه هي الحال الصادقة للجبهة المتقدمة في منتصف 2026.