بيانات نماذج · موثّقة بيانات موثّقة ← مقارنة واضحة ← قرار أفضل
ابدأ المقارنة ←

شاهد ما يفعله الذكاء الاصطناعي فعلًا، واعرف كيف

ما بناه الناس هذا الأسبوع، وكيف تفعله أنت، وبأي أداة، وماذا تفعل حين لا يعمل. وكل ادعاء يسمّي مصدره وتاريخه.

ماذا يصنع الناس

كل الاكتشافات ←

أشياء تستطيع فعلها

ابدأ من هدف ←

شيء لا يعمل؟

كل الإصلاحات ←

ما غيّره المزوّدون

كل التغييرات ←

استكشف السجل

افتح المستكشف ←

أي نموذج، وما الذي يستطيعه، وكم يكلّف، وما الذي تغيّر. وكل رقم يسمّي الصفحة التي قُرئ منها وتاريخها.

مسار واحد واضح

قارن · اختبر · اختر.

ثلاث خطوات. لا يوجد فائز يصلح للجميع.

38نموذج موثّق
25تغيير مسجّل
41حالة إيقاف
4 فئاتلتصنيف الأدلة

قراءة مقترحة

GPT-6 Astra

OpenAI · نموذج AI موثّق

مراجعة نموذج

مستجدات النماذج

ما تغيّر مؤخراً

عرض كل التغييرات ←
جارٍ التحميلجارٍ قراءة سجل التغييرات الموثّق…
  1. 01

    GPT-6 Astra

    OpenAI · نموذج AI موثّق

  2. 02

    Gemini 3.8 Flash: السعر نفسه، والفاتورة مختلفة

    يحمل Gemini 3.8 Flash بطاقة أسعار مطابقة لـ 3.7 Flash إلى آخر سنت. تقول Google إنه ينفق توكنز أكثر عن قصد، وهناك يقع الفارق.

  3. 03

    Claude Fable 5.1: كاش أرخص وعقد ترحيل أكثر صرامة

    يحافظ Claude Fable 5.1 على سعر $10/$50 وسياق 1M، ويخفض قراءة الكاش إلى $0.25 لكل مليون توكن، ويغيّر سلوك فرض الأداة والتفكير.

  4. 04

    Qwen3.8-Flash

    Alibaba (Qwen) · نموذج AI موثّق

  5. 05

    GLM-5.3: نموذج برمجة بسياق 1M وأوزان ما زالت خلف بوابة أمان

    إصدار Z.AI المستضاف يضيف تحسينات ما بعد التدريب واستدلالاً دائماً وثلاثة بروتوكولات بسعر 1.40/4.40 دولار.

  6. 06

    Gemini 3.7 Flash: احسب نهاية السعر التمهيدي قبل الترحيل

    نموذج Google المستقر يبدأ بسعر 0.75/3.75 دولار حتى نهاية 2026، مع سياق يتجاوز مليون توكن وتغيير سعر مؤرخ.

  7. 07

    Grok 4.6: سياق 500K لوكلاء طويلين بلا رقم معلن لسقف الإخراج

    Grok 4.6 لوكلاء البرمجة الطويلة: يبدأ بسعر 2/6 دولارات، وتتضاعف الشريحة عند 200K، بلا سقف إخراج رقمي منشور.

  8. 08

    Qwen3.8-Max

    Alibaba (Qwen) · نموذج AI موثّق

مراجعات

  1. 07

    Claude Opus 5

    ‏Opus الحالي من Anthropic بالسعر نفسه $5/$25 — ما الذي تغيّر عن 4.8، ومن ينبغي أن ينتقل.

  2. 08

    GPT-5

    مرشح للعمل البصري والمخرجات المنظمة وفق تموضع OpenAI المنشور؛ تحقّق منه على مطالباتك أنت.

  3. 09

    Gemini 3 Pro

    نموذج متعدد الوسائط متقاعد؛ أوقفته Google في مارس 2026 لصالح Gemini 3.1 Pro.

مقارنات

  1. 10

    مساعدو البرمجة

    Cursor وGitHub Copilot وWindsurf وCody في نفس مهمة تصدير Markdown.

  2. 11

    نماذج الصوت

    ElevenLabs وOpenAI Whisper وCartesia Sonic في الكمون والدقة والطبيعية.

  3. 12

    سعات السياق

    سعة السياق المعلنة مقابل فحوص استرجاع قابلة للتكرار على مستنداتك أنت.

تحليلات

  1. 13

    السعر حسب حالة الاستخدام

    أرخص نموذج للدردشة والبرمجة وRAG والوكلاء والتصنيف والتلخيص.

  2. 14

    طبقة النماذج مفتوحة الأوزان

    أين تقف Llama 4 وMistral Large 3 وDeepSeek-V4 وQwen 3.6 أمام المختبرات المغلقة.

  3. 15

    لماذا توقّفت المعايير عن إخبارنا بشيء

    تقاربت النتائج العليا على MMLU قرب 90%. نوضح الاختبارات التي ما زالت تكشف الفروق بين النماذج.

أدلة

  1. 16

    النماذج الحدّية

    Claude Opus 4.7 وGPT-5 وGemini 3.1 Pro Preview: مواصفات موثقة ومفاضلات تحريرية وخطة تقييم محلية.

  2. 17

    النماذج مفتوحة الأوزان

    دليل عملي إلى Llama 4 وMistral وDeepSeek وQwen والنماذج الصغيرة، وما الذي يتطلّبه تشغيلها على خوادمك بنفسك.

  3. 18

    تكاليف الذكاء الاصطناعي

    ما يكلّفه الذكاء الاصطناعي حسب النموذج وطبيعة العمل، والأماكن التي تُبالغ فيها الفرق في الإنفاق.

قارن النماذج مباشرةً

مرجع تفاعلي للأسعار ونتائج الاختبارات وسعات السياق وتقييمات القدرات للنماذج الـ38 في الفهرس.

افتح أداة المقارنة

جميع النماذج الـ 38 مرتبةً حسب تقييم benchr →

جميع المقالات الـ 114 في الأرشيف →

أحدث إصدارات النماذج →

أدلة OpenAI وAnthropic وGoogle والنماذج مفتوحة الأوزان →

دليل معرّفات API وبيانات المطورين →

‏benchr مرجع قائم على الأدلة، لا قائمة عامة. نميّز بين بيانات المزوّد الرسمية، ونتائج المعايير المنشورة من أطراف ثالثة، وتقديرات benchr التحريرية حتى يستطيع القارئ تقييم الدليل خلف كل ادعاء.

تحديثات benchr

تابع الإصدارات الجديدة وتغيّرات الأسعار عبر RSS وصفحات التحديث المنشورة.