تفصيل التسعير
| الطبقة | السعر / مليون توكن |
|---|---|
| إدخال قياسي | $5.00 |
| إخراج قياسي | $25.00 |
| إدخال مخزّن | $0.50 |
| إدخال Fast Mode | $10.00 |
| إخراج Fast Mode | $50.00 |
| الدُّفعات (خصم 50%) | $2.50 / $12.50 |
| سعة السياق | 1,000,000 توكن |
| أقصى إخراج | 128,000 توكن |
كيف تفسّر البنشمارك البرمجي
تبلغ نتيجة Claude Opus 4.8 المنشورة 88.6% على SWE-bench Verified. لدى DeepSeek V4-Pro نتيجة منفصلة منشورة من مزوّده عند 80.6%، بينما لا تنشر مواد Google التي راجعناها رقمًا قابلًا للمقارنة مباشرة لـGemini 3.5 Flash، وكانت قيمة GPT-5.5 السابقة في benchr غير مدعومة. حُذفت المقارنات غير المسندة؛ وحتى الفروق الموثقة لا تثبت وحدها محاولات أقل أو كلفة أدنى أو نجاحًا أعلى في مستودعك.
تسجل البطاقة نفسها GPQA Diamond عند 93.6% وHumanEval عند 96% وMMLU عند 93.5%. تعامل معها كإشارات خاصة بمهام بعينها، ثم اختبر صيغة البرومبت واستخدام الأدوات والصحة والكلفة على مجموعة تقييم ممثلة.
مقارنة سعر الإخراج 25$ مقابل 30$
في لقطة الأسعار المؤرخة، يدرج كل من Claude Opus 4.8 وGPT-5.5 سعر 5$ للمليون إدخال، فيما يبلغ إخراج Opus 25$ مقابل 30$ للمليون — أقل بنسبة 17% لكل توكن إخراج. تكون كلفة Opus التوكنية أدنى فقط حين تستخدم المهام المقارنة أحجام الإدخال والإخراج نفسها؛ وقد تعكس معدلات النجاح أو إعادة المحاولة أو أطوال الاستجابة المختلفة النتيجة لكل مهمة ناجحة.
مثال: عند تطابق 5 آلاف توكن إدخال و20 ألف إخراج، يبلغ إجمالي Opus 4.8 0.525$ وGPT-5.5 0.625$. عند 100 ألف مهمة مماثلة يكون الفرق الحسابي 10,000$. ولا تثبت أرقام البنشمارك المنشورة منفصلًا ميزة جودة لهذا الحمل.
تخزين السياق: خصم الـ 90%
توكنز الإدخال المخزّنة تكلّف 0.50$ للمليون — خصم 90% عن السعر القياسي 5$ للمليون. يبقى التخزين فعّالًا حتى خمس دقائق. برومبت نظام بحجم 100 ألف توكن يُرسَل 100 مرة في الساعة يكلّف 50$ بلا تخزين؛ وعند افتراض إصابة 90% تصبح كلفة الإدخال النموذجية 9.50$. يعتمد التوفير الفعلي على التوكنز المؤهلة وكتابة الكاش وانتهائه ومعدل الإصابة الذي ترصده.
Fast Mode: حين يكون الكمون هو القيد
يضاعف Fast Mode السعر المدرج إلى 10$ للمليون إدخال و50$ للمليون إخراج في هذه اللقطة. لا تنشر Anthropic رقمًا عامًا لزمن أول توكن أو التوكنات في الثانية يصلح لكل منطقة وشكل طلب، ولم يجرِ benchr قياسًا مضبوطًا عبر المناطق. لذلك حُذفت قيم الكمون غير الموثقة التي ظهرت في المقارنات. اختبر الوضعين من منطقة نشرك.
متى يكفي Sonnet
قد يكلّف Claude Opus 4.8 أكثر بكثير من نموذج من طبقة Sonnet بحسب مزيج التوكنز والتخزين. ابدأ بتقييم النموذج الأرخص المؤهل، وحدد حالات الفشل، ثم اختبر هل يحسن توجيهها إلى Opus النتيجة بما يغطي الكلفة الإضافية. تستخرج نسبة التوجيه المناسبة من تقييمك؛ ولا يدّعي benchr نسبة إنتاجية عامة.
ملاءمة الاستخدام
مرشح لـ: مهام البرمجة المؤتمتة الصعبة وخطوط الوكلاء المركبة والاستدلال المعماري، بشرط أن يظهر تقييم ممثل ميزة عند كلفة مقبولة.
قارن البدائل إن: احتجت حجمًا منخفض الكلفة أو كمونًا منخفضًا، أو لم تستفد مهمتك من فرق البنشمارك المنشور. اختبر الخيارات الحالية بدل افتراض نموذج افتراضي عام.
قائمة القرار
قبل توجيه حركة الإنتاج إلى Opus 4.8، شغّل المهمة نفسها على Claude Sonnet 4.6 وقِس المخرجات المقبولة وعبء المراجعة وإعادة المحاولات والكمون وكلفة التوكنات. إن اجتاز Sonnet عتبتك فهو المرشح الأقل سعرًا. ومع GPT-5.5 استخدم مقارنة موزونة بالإخراج، لا سعر الإدخال وحده.
افحص هل يستفيد حملك من التخزين. برومبتات النظام الكبيرة المتكرّرة تجعل Opus 4.8 أرخص بكثير ممّا يوحي به السعر المعلن. برومبت نظام بحجم 50 ألف توكن بمعدّل إصابة تخزين 90% يخفض كلفة الإدخال الفعلية إلى نحو 0.95$ للمليون.