الرسوم البيانية · محدَّث يونيو 2026

الرسوم البيانية لنماذج الذكاء الاصطناعي

قارن قدرة النماذج بسعر API، ثم اضبط الأولويات بحسب استخدامك. يعرض الرسم الوزن التحريري الافتراضي، ويعيد المستكشف حساب الترتيب كلما غيّرت أحد الأبعاد.

البيانات من models.json الترتيب محسوب من البيانات — لا مواضع مدفوعة أبداً

القدرة مقابل سعر API

تمثّل كل نقطة نموذجاً. يستخدم المحور الرأسي وزن القدرات الافتراضي من 100: البرمجة 40%، والاستدلال 40%، والكتابة 20%. تعتمد درجات البرمجة والاستدلال على نتائج الاختبارات الموثقة حين تتوفر، وتبقى التقديرات والقيم الناقصة معلّمة بوضوح. أما المحور الأفقي فهو متوسط سعري الإدخال والإخراج لكل مليون توكن. يمكن استخدام الجدول أدناه بلوحة المفاتيح أو قارئ الشاشة.

اعرض بيانات الرسم في جدول

جارٍ تحميل بيانات الرسم…

نطاقات المحاور تتكيّف مع البيانات — لا نموذج مثبّت عند الحافة. الأسعار من وثائق المزوّدين الرسمية (يونيو 2026)؛ النماذج المجانية/بالاستضافة الذاتية مُزاحة قليلاً عن محور الـ $0 كي لا تتكدّس تسمياتها.

مستكشف نتائج الاختبارات

حرّك الأشرطة لتحديد ما يهمك، وسيتحدّث الترتيب فوراً. يمكنك تصفير أي بُعد لا تحتاجه؛ فمثلاً قد تصفّر فرق البرمجة وزني الكتابة وتعدد اللغات. وإذا منحت وزناً لبُعد لا يملك النموذج بيانات فيه، مثل الرؤية في نموذج نصّي، فسيُحتسب بصفر كي لا تختفي البيانات الناقصة من الحساب.

البرمجة 40%
الاستدلال 40%
الكتابة 20%
الرؤية 0%
سعة السياق 0%
تعدد اللغات 0%

جارٍ التحميل…

كيف تُحتسب هذه الدرجة. رقم كل نموذج متوسط موزون (0–100) للأبعاد التي ضبطتها أعلاه. تستخدم البرمجة نتيجة SWE-bench Verified، ويستخدم الاستدلال نتيجة GPQA Diamond. كلاهما اختبار مرجعي موثق: نعرض رقم المزوّد حين ينشره، ونضع علامة «تقديري» حين تكون القيمة من تقدير benchr. أما الكتابة والرؤية وسعة السياق وتعدد اللغات فهي تقييمات تحريرية من benchr وليست اختبارات مختبرية؛ راجع المنهجية. يحتسب أي بُعد بلا بيانات بقيمة 0 ولا يُسقط من الحساب. تُقاس الأشرطة إلى المتصدر الحالي، وتظهر الدرجات بخانة عشرية واحدة لتمييز النماذج المتقاربة.

مفيد أيضاً

→ الفهرس المرتّب الكامل مع تقييم benchr → حاسبة التكلفة — تقدير شهري حسب الاستهلاك → اقتراح نموذج — أجب عن ثلاثة أسئلة → المقارنة جنباً إلى جنب

أسئلة شائعة

أي نموذج ذكاء اصطناعي يقدّم أفضل قدرة لكل دولار؟

لا يوجد فائز ثابت؛ تتغير النتيجة مع أوزان البرمجة والاستدلال والكتابة ومزيج الإدخال والإخراج. استخدم الرسم لبناء قائمة قصيرة، ثم احسب تكلفتك واختبر النماذج على حالاتك.

ماذا يقيس المحور الرأسي (القدرة)؟

المحور الرأسي الافتراضي يستخدم البرمجة (40%) + الاستدلال (40%) + الكتابة (20%) من درجات القدرة التحريرية لدى benchr. استخدم الأشرطة في المستكشف لتغيير الوزن وفق حمل عملك.

لماذا تظهر نماذج الاستضافة الذاتية قرب سعر الصفر؟

يشير موضعها إلى غياب سعر API عام لكل توكن أو إلى رسوم رخصة صفرية، لا إلى أن تشغيلها مجاني. تبقى تكلفة العتاد أو السحابة والتخزين والشبكات والمراقبة والعمل الهندسي خارج هذا المحور.

هل يمكنني مشاركة الرسوم أو بياناتها؟

يمكنك مشاركة رابط الصفحة، وتنزيل ملف models.json العام وإعادة استخدام بياناته بموجب رخصة CC BY 4.0 مع الإسناد. لا يدعم الموقع تضمين صفحات الأدوات خارجياً عبر iframe بسبب سياسة الأمان.

تحديثات benchr

تابع الإصدارات الجديدة وتغيّرات الأسعار عبر RSS وصفحات التحديث المنشورة.