مقارنة تكلفة APIs والاستضافة الذاتية
تُرتّب واجهات API حسب متوسط سعري الإدخال والإخراج. وتظهر السجلات التي لا تملك زوج أسعار API كاملاً في جدول منفصل من دون مرتبة. غياب سعر API لا يعني أن الرخصة أو التشغيل مجانيان. البيانات من وثائق المزوّدين الرسمية، محدَّثة يونيو 2026.
| المرتبة | النموذج | المزوّد | متوسط الإدخال والإخراج $/1M | الإدخال $/1M | الإخراج $/1M |
|---|---|---|---|---|---|
| جارٍ تحميل أسعار واجهات API المستضافة… | |||||
نماذج بلا سعر API لكل توكن
قد تكون هذه السجلات متاحة للاستضافة الذاتية، لكن الفهرس لا يملك لها زوجاً كاملاً من سعري الإدخال والإخراج كي يرتّبها. شروط الرخصة وتكلفة البنية التحتية مسألتان منفصلتان.
| النموذج | المزوّد | الحالة في هذا التصنيف | التكلفة التي يجب حسابها |
|---|---|---|---|
| جارٍ تحميل السجلات غير المسعّرة… | |||
كيف تقرأ أسعار الفئة الاقتصادية؟
تبدّلت الفئة الاقتصادية مرتين في أربعة أسابيع. نقلت DeepSeek نماذج V4 إلى تسعير ذروة وخارج ذروة في 16 أغسطس 2026، فصار إدخال V4-Flash $0.44 لكل مليون توكن داخل ساعات الذروة (01:00–04:00 و06:00–10:00 بالتوقيت العالمي من الاثنين إلى الجمعة) و$0.22 في بقية الأسبوع، بعد أن كان سعرًا ثابتًا قدره $0.14. وانتقلت الصدارة على المؤشر المدمج حينها إلى MiniMax M3 عند $0.75. ثم أوقفت DeepSeek في 10 سبتمبر نموذج V4-Flash المستضاف، وصار المعرّف deepseek-v4-flash يحوّل مؤقتًا إلى DeepSeek-V4.1-Flash بسعر $0.30 للإدخال و$1.20 للإخراج لكل مليون توكن في الذروة، و$0.15 / $0.60 خارجها. ما زالت أوزان V4-Flash برخصة MIT متاحة للتنزيل والاستضافة الذاتية، لكن صفّه في الجدول سجلّ لواجهة متوقفة إلى أن يُحدَّث الفهرس المشترك، لا سعر ساري.
يتصدّر المؤشر المدمج الآن Qwen3.8-Flash بسعر $0.15 للإدخال و$0.47 للإخراج لكل مليون توكن (متوسط $0.31)، متقدمًا على MiniMax M3. ولا يظهر في هذا المؤشر بعد مساران منخفضا الكلفة: DeepSeek-V4.1-Flash، وGPT-5.6 Luna من OpenAI بسعر $0.20 للإدخال و$1.20 للإخراج لكل مليون توكن، وهو أرخص من GPT-5 Mini في الجانبين. يعرض الجدول سعر الذروة حيث يوجد، لأنه ما تدفعه ما لم تجدول طلباتك عمدًا خارجه.
وهناك خيار أحدث لا يظهر في هذا المؤشر بعد: أصدرت Z.ai نموذج GLM-5.3-Flash في 26 أغسطس 2026 بسعر $0.15 لكل مليون إدخال و$0.50 للإخراج، وبنصف ذلك ($0.075 و$0.25) حتى 9 سبتمبر، وقد انتهى هذا العرض الترويجي. النموذج مسجَّل في سجل benchr الموثّق لكنه لم يُضف بعد إلى مجموعة الأدوات التي يقرأ منها هذا الترتيب، فتعامل معه بوصفه خيطًا تتحقق منه لا صفًا تقارنه هنا.
لا يكفي سعر الإدخال وحده للمقارنة؛ أضف سعر الإخراج والتخزين المؤقت والدفعات وعدد الإعادات.
السعر المنخفض لا يعني أن النموذج يقتصر على المهام البسيطة. تورد DeepSeek نتيجة 79.0% على SWE-bench Verified لـ V4-Flash، الذي ما زالت أوزانه المفتوحة متاحة، وتورد OpenAI نتيجة 79.8% لـ GPT-5.6 Luna بسعر $0.20 للإدخال و$1.20 للإخراج لكل مليون توكن. هذه أرقام المزوّدين وليست اختبارًا مستقلًا متكافئًا؛ استخدمها لبناء قائمة قصيرة، ثم اختبر المهمة نفسها على النموذجين.
الاستضافة الذاتية مقابل API المُدار: المفاضلة الحقيقية
قد يكون السجل غير المسعّر نموذجاً مفتوح الأوزان للاستضافة الذاتية، أو نموذجاً لم ينشر المزوّد له سعر توكن كاملاً. لا يكشف غياب سعر API عن شروط الرخصة أو تكلفة التشغيل. وعند الاستضافة الذاتية يجب حساب العتاد أو السحابة والتخزين والشبكات والمراقبة والأمن ووقت الفريق.
لا توجد نقطة تعادل عامة تصلح لكل نموذج وفريق. احسبها من متطلبات الذاكرة والتكميم والتزامن ونسبة إشغال العتاد وحجم الاستخدام، ثم قارنها بفاتورة API الفعلية وبالعمل التشغيلي الذي ستتحمله.
المنهجية
متوسط سعر الإدخال والإخراج = (سعر الإدخال + سعر الإخراج) ÷ 2. لا يدخل الترتيب إلا السجلات التي تملك السعرين كرقمين، وتظهر البقية منفصلة بلا افتراض عن الرخصة أو تكلفة التشغيل. كل أسعار API مأخوذة من وثائق المزوّدين الرسمية، ومُتحقَّق منها في 3 يونيو 2026. استخدم حاسبة التكلفة لإدخال مزيج التوكنز الخاص بك.
متى لا يكون النموذج الأرخص هو الخيار الأرخص
السعر المنخفض للتوكن لا يفوز إلا حين يُنجز النموذج المهمة بمعدل إعادة محاولة مماثل وتكلفة مراجعة بشرية مماثلة. إذا أنتج نموذج أرخص توليدين فاشلين إضافيين مقابل كل إجابة ناجحة، فإن التوفير الظاهري يتلاشى بسرعة. قِس التكلفة لكل نتيجة مقبولة، لا التكلفة لكل توكن مُولَّد.
استخدم هذا التصنيف لبناء قائمة أولية، ثم اختبر مرشحًا اقتصاديًا وآخر متوسط السعر وثالثًا أعلى فئة على 100 إلى 300 مثال من عملك. احسب كلفة المخرجات التي يقبلها فريقك فقط، وأدخل إعادة المحاولة ووقت المراجعة في الحساب.
وتيرة التحديث والتحقق
تُراجَع الأسعار في هذا الجدول مقابل وثائق المزوّدين حين يصدر نموذج كبير، أو حين يعلن مزوّد تغييراً في الأسعار، أو حين يُحدّث benchr فهرس النماذج المشترك. ولأن أسعار API قد تتغير بهدوء، يجب التعامل مع الجدول كأداة قرار، لا كعقد شراء. قبل توقيع اتفاق مزوّد طويل الأمد، راجع صفحة التسعير الحيّة للمزوّد وأي خصومات مؤسسية متاحة لحسابك.
يفصل الجدول أيضاً سعر التوكن عن ملاءمة المنصة. قد يكون نموذج هو الأرخص ويبقى لكن خاطئاً لفريق يحتاج دعم SDK قائماً، أو مراجعة SOC، أو ضمانات منطقة سحابية، أو موافقة داخلية على مزوّد بعينه. تلك القيود تنتمي إلى ورقة تقييمك بجانب تكلفة التوكن.
أسئلة شائعة
ما أقل سعر API مستضاف في هذه اللقطة؟
في مجموعة benchr الحالية، يسجّل Qwen3.8-Flash أدنى سعر مدمج عند $0.15 إدخالاً و$0.47 إخراجاً لكل مليون توكن، يليه MiniMax M3 عند $0.30 / $1.20. وخارج المؤشر، يكلّف DeepSeek-V4.1-Flash، الذي حلّ محل V4-Flash المستضاف في 10 سبتمبر 2026، $0.30 / $1.20 في ساعات ذروة DeepSeek و$0.15 / $0.60 خارجها، ويكلّف GPT-5.6 Luna $0.20 / $1.20. تحقّق من بطاقة المزوّد الحالية قبل وضع الميزانية.
هل النماذج مفتوحة الأوزان بالاستضافة الذاتية مجانية؟
قد تكون رسوم الرخصة صفراً، لكن تشغيل النموذج يحتاج إلى عتاد أو خدمة سحابية وتخزين وشبكات ومراقبة ووقت هندسي. لا توجد نقطة تعادل واحدة تصلح للجميع؛ احسبها من النموذج والعتاد ونسبة الإشغال وحجم الاستخدام ومتطلبات التشغيل لديك.
كيف يُحسب متوسط سعر الإدخال والإخراج؟
يُحسب المتوسط بجمع سعر الإدخال وسعر الإخراج ثم القسمة على اثنين، بافتراض مزيج متساوٍ بينهما. إنه مرجع مبسّط للمقارنة، لا تقديراً لفاتورتك؛ استخدم الحاسبة بمزيج التوكنز الفعلي لديك.