تفصيل التسعير
| الطبقة | السعر / مليون توكن |
|---|---|
| إدخال قياسي | $5.00 |
| إخراج قياسي | $25.00 |
| إدخال مخزّن | $0.50 |
| إدخال Fast Mode | $10.00 |
| إخراج Fast Mode | $50.00 |
| الدُّفعات (خصم 50%) | $2.50 / $12.50 |
| سعة السياق | 1,000,000 توكن |
| أقصى إخراج | 128,000 توكن |
كيف تفسّر البنشمارك البرمجي
تبلغ نتيجة Claude Opus 4.8 المنشورة 88.6% على SWE-bench Verified. استخدمت المقارنة الأصلية في هذه الصفحة لقطة يونيو 2026: GPT-5.5 عند 84.0%، وGemini 3.5 Flash وDeepSeek V4-Pro عند 80.6%. يختبر SWE-bench إعدادًا محددًا لهندسة البرمجيات؛ ولا تثبت فجوة النقاط وحدها محاولات أقل أو كلفة أدنى أو نجاحًا أعلى في مستودعك.
تسجل البطاقة نفسها GPQA Diamond عند 93.6% وHumanEval عند 96% وMMLU عند 93.5%. تعامل معها كإشارات خاصة بمهام بعينها، ثم اختبر صيغة البرومبت واستخدام الأدوات والصحة والكلفة على مجموعة تقييم ممثلة.
مقارنة سعر الإخراج 25$ مقابل 30$
في لقطة الأسعار المؤرخة، يدرج كل من Claude Opus 4.8 وGPT-5.5 سعر 5$ للمليون إدخال، فيما يبلغ إخراج Opus 25$ مقابل 30$ للمليون — أقل بنسبة 17% لكل توكن إخراج. تكون كلفة Opus التوكنية أدنى فقط حين تستخدم المهام المقارنة أحجام الإدخال والإخراج نفسها؛ وقد تعكس معدلات النجاح أو إعادة المحاولة أو أطوال الاستجابة المختلفة النتيجة لكل مهمة ناجحة.
مثال: عند تطابق 5 آلاف توكن إدخال و20 ألف إخراج، يبلغ إجمالي Opus 4.8 0.525$ وGPT-5.5 0.625$. عند 100 ألف مهمة مماثلة يكون الفرق الحسابي 10,000$. ولا تثبت أرقام البنشمارك المنشورة منفصلًا ميزة جودة لهذا الحمل.
تخزين السياق: خصم الـ 90%
توكنز الإدخال المخزّنة تكلّف 0.50$ للمليون — خصم 90% عن السعر القياسي 5$ للمليون. يبقى التخزين فعّالًا حتى خمس دقائق. برومبت نظام بحجم 100 ألف توكن يُرسَل 100 مرة في الساعة يكلّف 50$ بلا تخزين؛ وعند افتراض إصابة 90% تصبح كلفة الإدخال النموذجية 9.50$. يعتمد التوفير الفعلي على التوكنز المؤهلة وكتابة الكاش وانتهائه ومعدل الإصابة الذي ترصده.
Fast Mode: حين يكون الكمون هو القيد
يضاعف Fast Mode السعر المدرج إلى 10$ للمليون إدخال و50$ للمليون إخراج في هذه اللقطة. رقم 700 مللي ثانية للتوكن الأول و68 توكنًا في الثانية الواردان في مقارنات benchr هما تقديران تحريريّان للتخطيط وليسا اتفاقية مستوى خدمة من Anthropic؛ كما أن أرقام GPT-5.5 وGemini المستخدمة للمقارنة تقديرات من لقطة مؤرخة مختلفة. قد تغيّر المنطقة والحمل وطول البرومبت والأدوات وطبقة الخدمة الكمون جذريًا، لذا اختبر الوضعين من منطقة نشرك.
متى يكفي Sonnet
قد يكلّف Claude Opus 4.8 أكثر بكثير من نموذج من طبقة Sonnet بحسب مزيج التوكنز والتخزين. ابدأ بتقييم النموذج الأرخص المؤهل، وحدد حالات الفشل، ثم اختبر هل يحسن توجيهها إلى Opus النتيجة بما يغطي الكلفة الإضافية. تستخرج نسبة التوجيه المناسبة من تقييمك؛ ولا يدّعي benchr نسبة إنتاجية عامة.
ملاءمة الاستخدام
مرشح لـ: مهام البرمجة المؤتمتة الصعبة وخطوط الوكلاء المركبة والاستدلال المعماري، بشرط أن يظهر تقييم ممثل ميزة عند كلفة مقبولة.
قارن البدائل إن: احتجت حجمًا منخفض الكلفة أو كمونًا منخفضًا، أو لم تستفد مهمتك من فرق البنشمارك المنشور. اختبر الخيارات الحالية بدل افتراض نموذج افتراضي عام.
قائمة القرار
قبل توجيه حركة الإنتاج إلى Opus 4.8، شغّل المهمة نفسها على Claude Sonnet 4.6 وقِس المخرجات المقبولة وعبء المراجعة وإعادة المحاولات والكمون وكلفة التوكنات. إن اجتاز Sonnet عتبتك فهو المرشح الأقل سعرًا. ومع GPT-5.5 استخدم مقارنة موزونة بالإخراج، لا سعر الإدخال وحده.
افحص هل يستفيد حملك من التخزين. برومبتات النظام الكبيرة المتكرّرة تجعل Opus 4.8 أرخص بكثير ممّا يوحي به السعر المعلن. برومبت نظام بحجم 50 ألف توكن بمعدّل إصابة تخزين 90% يخفض كلفة الإدخال الفعلية إلى نحو 0.95$ للمليون.