أقل واجهات LLM المستضافة سعراً ضمن تتبع benchr: لقطة 24 يوليو 2026

قارن أقل أسعار الرموز لدى DeepSeek وGPT-5 Mini وClaude Haiku، إلى جانب تكلفة النماذج مفتوحة الأوزان ذاتية الاستضافة.

بقلم فريق benchr التحريري · · رُوجع نطاق المقارنة ولقطة الأسعار في 24 يوليو 2026 · سجل التغييرات

أقل واجهات LLM المستضافة سعراً ضمن تتبع benchr: لقطة 24 يوليو 2026: شرائط سعر ومسارات تقيس التوكنات.
لوحة تحريرية من benchr أقل واجهات LLM المستضافة سعراً ضمن تتبع benchr تدفق الاستخدام · التكلفة الكاملة
تحليل تكلفةيرافق أقل واجهات LLM المستضافة سعراً ضمن تتبع benchr: لقطة 24 يوليو 2026 تصميم يقوم على شرائط سعر ومسارات تقيس التوكنات.

للمهام عالية الحجم مثل إدخال مستندات RAG، وتوجيه محادثات المستخدمين، واستخراج البيانات المنظمة، يكون اختيار نموذج منخفض التكلفة ضرورياً. أدناه قائمة مرتبة بكل النماذج في benchr التي تكلف $1.00 أو أقل لكل مليون رمز إدخال، أو هي نماذج مفتوحة الأوزان موجهة للاستضافة الذاتية المجانية.

النموذج المزود الإدخال / 1M الإخراج / 1M الرخصة
Qwen3.6-27BAlibabaاستضافة ذاتيةاستضافة ذاتيةمفتوح الأوزان
Llama 4 MaverickMetaاستضافة ذاتيةاستضافة ذاتيةمفتوح الأوزان
Llama 4 ScoutMetaاستضافة ذاتيةاستضافة ذاتيةمفتوح الأوزان
Phi-4Microsoftاستضافة ذاتيةاستضافة ذاتيةمفتوح الأوزان
GPT-5 MiniOpenAI$0.250$2.00ملكية
DeepSeek V4-FlashDeepSeek$0.440$1.32مفتوح الأوزان
Mistral Large 3Mistral$0.500$1.50مفتوح الأوزان
Kimi K2.6Moonshot AI$0.950$4.00مفتوح الأوزان
Claude Haiku 4.5Anthropic$1.00$5.00ملكية
DeepSeek V4-ProDeepSeek$1.32$3.96مفتوح الأوزان

تنبيه على صفَّي DeepSeek: هذه أسعار ساعات الذروة. وكل ما يُرسل خارج 01:00–04:00 و06:00–10:00 بالتوقيت العالمي في يوم عمل يكلّف نصف ذلك، فيصير V4-Flash عند 0.22$/0.66$ نحو أربعة أخماس الأسبوع.

أبرز النقاط في فئة التكلفة المنخفضة

  • DeepSeek V4-Flash ($0.44/$1.32 في الذروة، $0.22/$0.66 خارجها): قضى معظم 2026 بوصفه أرخص نافذة سياق بمليون رمز في السوق، ثم رفع سعر إدخاله ثلاثة أضعاف في 16 أغسطس وربط الخصم بإرسال الطلبات خارج ساعات العمل الأوروبية والآسيوية. لم تتغير نتائج البرمجة والاستدلال؛ ما تغيّر هو حجّة الميزانية. ومع سرعته وانخفاض تكلفته، يحافظ على نتائج قوية في البرمجة والاستدلال.
  • GPT-5 Mini ($0.25/$2.00): خيار OpenAI الأساسي منخفض التكلفة، بسرعة عالية (160 رمز/ثانية) وتكامل كامل مع ميزات API مثل Structured Outputs وBatch Jobs.
  • Claude Haiku 4.5 ($1.00/$5.00): رغم أنه أعلى سعراً من DeepSeek وGPT-5 Mini، فإنه يملك قدرات قوية في تخزين المطالبات مؤقتاً، مع بصمة Anthropic المعروفة في السلامة وضبط التنسيق.

تريد مقارنتها بالنماذج الرئيسية؟ راجع ترتيب نماذج الذكاء الاصطناعي الكامل أو احسب تسعير الحجم بدقة عبر حاسبة التكلفة.

متى يتوقف الرخيص عن كونه رخيصاً

أرخص API ليس دائماً أقل نظام تكلفة. قد يخسر نموذج أقل سعراً إذا احتاج محاولات إعادة أكثر، أو أنتج إجابات أطول من اللازم، أو أخطأ في قيود التنسيق، أو احتاج مراجعة بشرية أكبر. في الإنتاج، المقياس المفيد هو تكلفة الإجابة المقبولة.

في التوجيه والاستخراج والتصنيف عالي الحجم، قد تكون النماذج الاقتصادية ممتازة لأن المهمة ضيقة ويسهل كشف الفشل. أما في المراجعة القانونية، وإصلاح الكود المعقد، وتلخيص الأبحاث، وحلقات الوكلاء ذات الأثر، فانتبه إلى تكلفة الفشل قبل تحسين فاتورة الرموز.

طريقة عملية لبناء قائمة مختصرة

بالنسبة إلى معظم الفرق، يجب أن ينتهي البحث عن النموذج الأرخص بقائمة مختصرة لا بفائز واحد. اختر نموذجاً تحت $0.50 لكل مليون رمز إدخال، ونموذجاً بين $0.50 و$1.50، وخياراً أقوى احتياطياً فوق ذلك. وجّه العمل السهل إلى الطبقة الأرخص، ولا تصعّد إلا عند فشل الثقة أو التنسيق أو فحوص السلامة.

بهذا يبقى النظام رخيصاً من دون أن تراهن بالمنتج كله على أدنى سطر في الجدول. كما يعطيك مسار ترقية واضحاً: إذا تحسن النموذج الاقتصادي زِد حصته، وإذا فشل في حالة طرفية فالمسار الاحتياطي موجود مسبقاً.

انتبه أيضاً إلى تركّز الاعتماد على مزود واحد. توفير بضعة دولارات لكل مليون رمز لا يستحق خسارة المرونة إذا كان العمل حرجاً. في الأنظمة المهمة، اجعل النموذج الأرخص خياراً افتراضياً مع مزود ثانٍ يستطيع استلام الحمل عند تدهور الكمون أو حدود المعدل أو التوفر.

ولا تجعل السعر وحده يحدد الثقة. إذا كان النموذج الأرخص جيداً في مهمة واحدة، فهذا لا يعني أنه يصلح لكل مهام المنتج. اربط كل قاعدة توجيه باختبار واضح، واحتفظ بسجل للحالات التي صُعّدت إلى نموذج أقوى حتى تعرف أين تنتهي طبقة التوفير.

أسئلة شائعة

هل كان DeepSeek V4-Flash الأقل سعراً بين النماذج المستضافة في لقطة benchr؟

خارج الذروة فقط. حافظ على أقل سعر مدرج حتى لقطة 24 يوليو 2026 عند $0.14 إدخالاً و$0.28 إخراجاً. ثم أعادت DeepSeek التسعير في 16 أغسطس 2026: ‏$0.44 و$1.32 داخل ساعات الذروة (01:00–04:00 و06:00–10:00 بالتوقيت العالمي من الاثنين إلى الجمعة)، و$0.22 و$0.66 في بقية الأسبوع. عند سعر الذروة يصبح GPT-5 Mini أرخص في الإدخال، وعند سعر ما خارجها يبقى V4-Flash أرخص صف في المجموعة. هذا ليس ضماناً للسوق كله؛ تحقّق من قائمة أسعار المزوّد الحية قبل اعتماد الميزانية.

هل أقدر استضافة النماذج مفتوحة الأوزان مجاناً؟

النماذج مفتوحة الأوزان مثل Llama 4 Scout أو Maverick أو Phi-4 مجانية التنزيل والاستخدام. لكن عليك تغطية تكاليف البنية التحتية للعتاد لتشغيلها (مثل تشغيل خوادم على AWS أو مواقع تأجير GPU).

هل النماذج مفتوحة الأوزان أرخص فعلاً من DeepSeek V4-Flash؟

يعتمد ذلك على حجمك. استضافة نموذج مثل Qwen3.6-27B أو Llama 4 Scout تتطلب استئجار GPU مثل A10G أو A100، ويُحاسب بالساعة. إذا كنت تنفذ ملايين الطلبات يومياً، تكون الاستضافة الذاتية غالباً أرخص. أما للأحجام الأقل أو الأعباء المتقطعة، فاستخدام API من DeepSeek أرخص بكثير ولا يحتاج صيانة.

سجل التغييرات

  • — قُيدت نتيجة أقل سعر بالنماذج المستضافة التي يتتبعها benchr في هذه اللقطة المؤرخة، وأُضيف فحص السعر الحي قبل اعتماد الميزانية.
  • — نُشرت النسخة الأولى. تم التحقق من كل الأسعار وفق وثائق API الرسمية للمزودين.

المصادر