منصة القرار لاختيار نماذج الذكاء الاصطناعي

ذكاء نماذج مدعوم بالمصادر، وحالات تقييمك، وسيناريوهات تكلفة الإنتاج، وتخطيط الترحيل — مترابطة في مساحة واحدة.

مساحة ذكاء لاختيار نماذج AI

استكشف. اختبر. قرّر. أطلق.

حوّل ادعاءات النماذج المتناثرة إلى قرار تستطيع الدفاع عنه: ابحث في بيانات موثّقة، كوّن قائمة قصيرة، اختبرها على حالاتك الفعلية، احسب التكلفة، وخطّط للترحيل قبل إيقاف أي نموذج.

ابدأ بالنتيجة

ما الذي تريد إنجازه اليوم؟

اختر هدفك، ويحوّله benchr إلى خطوة عملية — من دون ادعاء أن هناك نموذجاً واحداً يناسب الجميع.

01 · الدليل أولاًابدأ بقائمة قصيرة، لا بفائز جاهز.

صفِّ سجل النماذج بحسب حملك وحدّ السعر وسعة السياق. احفظ المرشحين الذين تستطيع تبريرهم لفريقك.

أنشئ قائمة قصيرة ←
27نموذج موثّق
25تغيير مسجّل
41حالة إيقاف
4 فئاتلتصنيف الأدلة

السجل الحي

آخر تغييرات النماذج

عرض كل التغييرات ←
جارٍ التحميلجارٍ قراءة سجل التغييرات الموثّق…

الأحدث

  1. 01

    GPT-5.6: Sol, Terra, Luna

    وصلت Sol وTerra وLuna إلى الإتاحة العامة في 9 يوليو. تعرض Sol الآن سياقاً بحجم 1.05 مليون توكن وتسعيراً قياسياً 5/30 دولار؛ وتحفظ المقالة مسار التصحيح من المعاينة إلى الإتاحة.

  2. 02

    Claude Fable 5

    عاد نموذج فئة Mythos بسعر 10/50 دولار إلى الإتاحة العالمية في 1 يوليو بعد تعليق 12–30 يونيو. ترفض الطلبات المصنفة أمنياً صراحةً، ولا تُعاد المحاولة بنموذج آخر إلا إذا هيّأ التطبيق ذلك.

  3. 03

    Claude Opus 4.8

    نفس سعر الإصدار 4.7، تحسّن طفيف في التصنيفات، ومكسب حقيقي في الأمانة يكشف أخطاء الكود من تلقاء نفسه.

  4. 04

    GPT-5.5

    مكاسب OpenAI تتركّز في البرمجة الآلية واستخدام الكمبيوتر، بسعر API يبلغ ضعف GPT-5 تقريباً.

  5. 05

    Opus 4.8 مقابل GPT-5.5

    كلاهما يسعّر مليون رمز إدخال عند 5 دولارات. قارن المواصفات المنشورة ثم تحقّق من الملاءمة على بنيتك التقنية.

  6. 06

    Claude Mythos

    نموذج Anthropic الحدّي المحجوب خلف مشروع Glasswing. ما هو وسبب إبقائه بعيداً عن العموم.

مراجعات

  1. 07

    Claude Opus 4.7

    قوي في قرارات البنية المعمارية وتحليل المستندات الطويلة. رؤية الصور هي نقطة ضعفه.

  2. 08

    GPT-5

    مرشح للعمل البصري والمخرجات المنظمة وفق تموضع OpenAI المنشور؛ تحقّق منه على مطالباتك أنت.

  3. 09

    Gemini 3 Pro

    نموذج متعدد الوسائط متقاعد؛ أوقفته Google في مارس 2026 لصالح Gemini 3.1 Pro.

مقارنات

  1. 10

    مساعدو البرمجة

    Cursor وGitHub Copilot وWindsurf وCody في نفس مهمة تصدير Markdown.

  2. 11

    نماذج الصوت

    ElevenLabs وOpenAI Whisper وCartesia Sonic في الكمون والدقة والطبيعية.

  3. 12

    سعات السياق

    سعة السياق المعلنة مقابل فحوص استرجاع قابلة للتكرار على مستنداتك أنت.

تحليلات

  1. 13

    السعر حسب حالة الاستخدام

    أرخص نموذج للدردشة والبرمجة وRAG والوكلاء والتصنيف والتلخيص.

  2. 14

    طبقة النماذج مفتوحة المصدر

    أين تقف Llama 4 وMistral Large 3 وDeepSeek-V4 وQwen 3.6 أمام المختبرات المغلقة.

  3. 15

    لماذا توقّفت المعايير عن إخبارنا بشيء

    MMLU بلغ سقفه عند 90%. المعايير التي يستحق متابعتها الآن.

أدلة

  1. 16

    النماذج الحدّية

    Claude Opus 4.7 وGPT-5 وGemini 3.1 Pro Preview: مواصفات موثقة ومفاضلات تحريرية وخطة تقييم محلية.

  2. 17

    النماذج مفتوحة المصدر

    دليل عملي إلى Llama 4 وMistral وDeepSeek وQwen والنماذج الصغيرة، وما الذي يتطلّبه تشغيلها على خوادمك بنفسك.

  3. 18

    تكاليف الذكاء الاصطناعي

    ما يكلّفه الذكاء الاصطناعي حسب النموذج وطبيعة العمل، والأماكن التي تُبالغ فيها الفرق في الإنفاق.

قارن النماذج مباشرةً

مرجع تفاعلي يغطي الأسعار ومعايير الأداء وسعات السياق وتقييمات القدرات لجميع النماذج الـ 29 في الفهرس، عبر الطبقات الحدّية والمتوسطة والمفتوحة.

افتح أداة المقارنة

جميع النماذج الـ 29 مرتبةً حسب تقييم benchr →

جميع المقالات الـ 102 في الأرشيف →

أحدث إصدارات النماذج →

‏benchr مرجع قائم على الأدلة، لا قائمة عامة. نميّز بين بيانات المزوّد الرسمية، ونتائج المعايير المنشورة من أطراف ثالثة، وتقديرات benchr التحريرية حتى يستطيع القارئ تقييم الدليل خلف كل ادعاء.

تحديثات benchr

تابع الإصدارات الجديدة وتغيّرات الأسعار عبر RSS وصفحات التحديث المنشورة.