تسعير Claude Opus 4.8 وسياق البنشماركات

تتضمن بطاقة Claude Opus 4.8 المنشورة 88.6% على SWE-bench Verified و93.6% على GPQA Diamond و96% على HumanEval. سعره 5$ للمليون إدخال و25$ للإخراج. هذه البنشماركات إشارات مفيدة، لكنها لا تثبت أن نموذجًا واحدًا يفوز في كل حمل إنتاجي.

من فريق benchr · · أُعيد فحص تسعير المزوّد والأرقام المنشورة؛ وتقديرات الأداء تحريرية · سجل التغييرات

الإدخال / مليونأنثروبيك · مايو 2026
الإخراج / مليونأنثروبيك
SWE-benchبحسب Anthropic
السياقأقصى سعة

تفصيل التسعير

claude-opus-4-8 — التسعير الرسمي من أنثروبيك
الطبقةالسعر / مليون توكن
إدخال قياسي$5.00
إخراج قياسي$25.00
إدخال مخزّن$0.50
إدخال Fast Mode$10.00
إخراج Fast Mode$50.00
الدُّفعات (خصم 50%)$2.50 / $12.50
سعة السياق1,000,000 توكن
أقصى إخراج128,000 توكن

كيف تفسّر البنشمارك البرمجي

تبلغ نتيجة Claude Opus 4.8 المنشورة 88.6% على SWE-bench Verified. استخدمت المقارنة الأصلية في هذه الصفحة لقطة يونيو 2026: ‏GPT-5.5 عند 84.0%، وGemini 3.5 Flash وDeepSeek V4-Pro عند 80.6%. يختبر SWE-bench إعدادًا محددًا لهندسة البرمجيات؛ ولا تثبت فجوة النقاط وحدها محاولات أقل أو كلفة أدنى أو نجاحًا أعلى في مستودعك.

تسجل البطاقة نفسها GPQA Diamond عند 93.6% وHumanEval عند 96% وMMLU عند 93.5%. تعامل معها كإشارات خاصة بمهام بعينها، ثم اختبر صيغة البرومبت واستخدام الأدوات والصحة والكلفة على مجموعة تقييم ممثلة.

مقارنة سعر الإخراج 25$ مقابل 30$

في لقطة الأسعار المؤرخة، يدرج كل من Claude Opus 4.8 وGPT-5.5 سعر 5$ للمليون إدخال، فيما يبلغ إخراج Opus ‏25$ مقابل 30$ للمليون — أقل بنسبة 17% لكل توكن إخراج. تكون كلفة Opus التوكنية أدنى فقط حين تستخدم المهام المقارنة أحجام الإدخال والإخراج نفسها؛ وقد تعكس معدلات النجاح أو إعادة المحاولة أو أطوال الاستجابة المختلفة النتيجة لكل مهمة ناجحة.

مثال: عند تطابق 5 آلاف توكن إدخال و20 ألف إخراج، يبلغ إجمالي Opus 4.8 ‏0.525$ وGPT-5.5 ‏0.625$. عند 100 ألف مهمة مماثلة يكون الفرق الحسابي 10,000$. ولا تثبت أرقام البنشمارك المنشورة منفصلًا ميزة جودة لهذا الحمل.

تخزين السياق: خصم الـ 90%

توكنز الإدخال المخزّنة تكلّف 0.50$ للمليون — خصم 90% عن السعر القياسي 5$ للمليون. يبقى التخزين فعّالًا حتى خمس دقائق. برومبت نظام بحجم 100 ألف توكن يُرسَل 100 مرة في الساعة يكلّف 50$ بلا تخزين؛ وعند افتراض إصابة 90% تصبح كلفة الإدخال النموذجية 9.50$. يعتمد التوفير الفعلي على التوكنز المؤهلة وكتابة الكاش وانتهائه ومعدل الإصابة الذي ترصده.

Fast Mode: حين يكون الكمون هو القيد

يضاعف Fast Mode السعر المدرج إلى 10$ للمليون إدخال و50$ للمليون إخراج في هذه اللقطة. رقم 700 مللي ثانية للتوكن الأول و68 توكنًا في الثانية الواردان في مقارنات benchr هما تقديران تحريريّان للتخطيط وليسا اتفاقية مستوى خدمة من Anthropic؛ كما أن أرقام GPT-5.5 وGemini المستخدمة للمقارنة تقديرات من لقطة مؤرخة مختلفة. قد تغيّر المنطقة والحمل وطول البرومبت والأدوات وطبقة الخدمة الكمون جذريًا، لذا اختبر الوضعين من منطقة نشرك.

متى يكفي Sonnet

قد يكلّف Claude Opus 4.8 أكثر بكثير من نموذج من طبقة Sonnet بحسب مزيج التوكنز والتخزين. ابدأ بتقييم النموذج الأرخص المؤهل، وحدد حالات الفشل، ثم اختبر هل يحسن توجيهها إلى Opus النتيجة بما يغطي الكلفة الإضافية. تستخرج نسبة التوجيه المناسبة من تقييمك؛ ولا يدّعي benchr نسبة إنتاجية عامة.

ملاءمة الاستخدام

مرشح لـ: مهام البرمجة المؤتمتة الصعبة وخطوط الوكلاء المركبة والاستدلال المعماري، بشرط أن يظهر تقييم ممثل ميزة عند كلفة مقبولة.

قارن البدائل إن: احتجت حجمًا منخفض الكلفة أو كمونًا منخفضًا، أو لم تستفد مهمتك من فرق البنشمارك المنشور. اختبر الخيارات الحالية بدل افتراض نموذج افتراضي عام.

قائمة القرار

قبل توجيه حركة الإنتاج إلى Opus 4.8، شغّل المهمة نفسها على Claude Sonnet 4.6 وقِس المخرجات المقبولة وعبء المراجعة وإعادة المحاولات والكمون وكلفة التوكنات. إن اجتاز Sonnet عتبتك فهو المرشح الأقل سعرًا. ومع GPT-5.5 استخدم مقارنة موزونة بالإخراج، لا سعر الإدخال وحده.

افحص هل يستفيد حملك من التخزين. برومبتات النظام الكبيرة المتكرّرة تجعل Opus 4.8 أرخص بكثير ممّا يوحي به السعر المعلن. برومبت نظام بحجم 50 ألف توكن بمعدّل إصابة تخزين 90% يخفض كلفة الإدخال الفعلية إلى نحو 0.95$ للمليون.

أسئلة شائعة

ماذا تخبرني نتيجة 88.6% المنشورة على SWE-bench؟

تسجّل أداءً على إعداد محدد لهندسة البرمجيات، وكانت مرتفعة في لقطة يونيو 2026 المستخدمة هنا. لا تثبت تصدّر السوق الآن أو معدل نجاح حملك الإنتاجي. أعد فحص لوحات الصدارة الحالية وشغّل مهامًا من مستودعك وفق عتبات نجاح ثابتة قبل الاختيار.

ما هو Fast Mode ومتى يهمّ؟

يستخدم Fast Mode طبقة السعر الأعلى المدرجة 10$/50$ للمليون ويستهدف خفض الكمون. رقم 700 مللي ثانية المستخدم لدى benchr تقدير تحريري للتخطيط، لا ضمانًا من Anthropic. اختبر الوضعين من منطقتك وببرومبتات ممثلة قبل تقرير إن كان فرق الكمون يبرر السعر.

كيف يعمل تخزين السياق مع Claude Opus 4.8؟

توكنز الإدخال المخزّنة تكلّف 0.50$ للمليون — خصم 90% عن السعر القياسي 5$. يبقى التخزين فعّالًا حتى خمس دقائق. عند معدّل إصابة 90% تنخفض كلفة الإدخال الفعلية إلى نحو 0.95$ للمليون. وهو أنفع ما يكون للوكلاء ذوي برومبتات النظام الكبيرة والثابتة، ولا يفيد في النداءات القصيرة عديمة الحالة.

سجل التغييرات

  • — وُسم البنشمارك الرئيسي بأنه منشور من المزوّد، ووُضح أن حساب سعر التوكن لا يثبت الجودة أو الكلفة لكل مهمة ناجحة.
  • — أزيلت ادعاءات الفوز العام والنجاح الإنتاجي، ووُسمت أرقام الكمون كتقديرات تحريرية، وصُحح مثال التخزين، وأضيف توجيه للتقييم الخاص بالمهمة.
  • — نشر النسخة العربية المستقلّة. الأرقام محقّقة مقابل صفحة أسعار أنثروبيك الرسمية.

المصادر

  • أسعار واجهة أنثروبيك — anthropic.com/api#pricing (محقّقة 6 يونيو 2026)
  • لوحة صدارة SWE-bench Verified — swebench.com (محقّقة 6 يونيو 2026)
  • ملف model-figures.json من benchr — محقّق 6 يونيو 2026