مقارنة مباشرة: للتفصيل حالة بحالة لِما يشتريه الدولار الإضافي مقارنة بـSonnet 4.6، وأين يظلّ Opus 4.8 متفوّقًا، راجع الأقسام أدناه. وتغطية الإطلاق تقدّم الصورة الأكمل للقدرات.
تفصيل التسعير
| الطبقة | السعر / مليون توكن |
|---|---|
| إدخال تمهيدي (حتى 31 أغسطس) | $2.00 |
| إخراج تمهيدي (حتى 31 أغسطس) | $10.00 |
| إدخال قياسي (من 1 سبتمبر) | $3.00 |
| إخراج قياسي (من 1 سبتمبر) | $15.00 |
| إدخال مخزّن | $0.20 تمهيديًا / $0.30 قياسيًا |
| الدُّفعات (خصم 50%) | $1.00 / $5.00 تمهيديًا؛ $1.50 / $7.50 قياسيًا |
| سعة السياق | 1,000,000 توكن |
| أقصى إخراج | 128,000 توكن |
السعر التمهيدي والسعر اللاحق
Claude Sonnet 5 هو ثاني نموذج تبنيه أنثروبيك على بنية Mythos التي قدّمتها مع Claude Fable 5 في 9 يونيو. وبدل تسميته «Sonnet 4.7» أو «4.8»، أنزلت أنثروبيك البنية الجديدة إلى طبقة Sonnet السعرية. أثناء الإطلاق هو أرخص من Sonnet 4.6: 2$ للمليون إدخال و10$ للإخراج حتى 31 أغسطس 2026. بدءًا من 1 سبتمبر ينتقل إلى 3$/15$، مطابقًا Sonnet 4.6 ودون Opus 4.8 البالغ 5$/25$. الإدخال المخزّن يكلّف 0.20$ للمليون في الفترة التمهيدية و0.30$ بعدها، وواجهة الدُّفعات تخفّض السعرين إلى النصف.
مقارنة البنشماركات المنشورة
تبلغ نتيجة Claude Sonnet 5 المنشورة 89.4% على SWE-bench Verified، فوق 88.6% لـClaude Opus 4.8 في اللقطة المشار إليها. SWE-bench بنشمارك مفيد ومحدد لهندسة البرمجيات، لكنه ليس مثبتًا بوصفه المتنبئ الوحيد أو الأدق بنجاح وكلاء البرمجة في الإنتاج. تسرد البطاقة المنشورة أيضًا 71.8% على SWE-bench Pro و85.6% على Terminal-Bench 2.1 و96.0% على HumanEval و93.5% على MATH. ويُدرج Opus 4.8 أعلى على GPQA Diamond عند 93.6% مقابل 92.0%. اختبر مزيج مهامك الفعلي بدل تحويل أي نتيجة إلى قاعدة توجيه عامة.
وبقيّة البطاقة: 1435 على LMSYS Arena، و93.8% على MMLU، و20.0 على ARC-AGI-2، و42.5% على Humanity's Last Exam بلا أدوات — ملف عام قوي لنموذج مُسعَّر أقل من الرائد.
حد إخراج يبلغ 128 ألف توكن
يدعم Claude Sonnet 5 128,000 توكن إخراج لكل استجابة — ضعف سقف Sonnet 4.6 البالغ 64,000 توكن. في الأحمال التي تولّد مستندات طويلة، أو فروقات (diffs) كبيرة، أو تعديلات كود متعدّدة الملفات في نداء واحد، يزيل هذا قيدًا حقيقيًا: المهام التي كانت تتطلّب تقسيم الاستجابة على عدّة نداءات لـ Sonnet 4.6 تتّسع الآن في نداء واحد لـ Sonnet 5، مع سياق كامل يبلغ 1,000,000 توكن متاح للقراءة منه.
التفكير التكيّفي والرفض الأمني الصريح
مثل Fable 5، يرث Claude Sonnet 5 التفكير التكيّفي: يقرّر النموذج عمق الاستدلال لكل طلب، ولا يوجد مفتاح تفكير موسّع يدوي. ترجع طلبات الأمن السيبراني الهجومي والأحياء/الكيمياء والتقطير المصنفة أمنياً برفض صريح، ولا تتوجه تلقائياً إلى Opus 4.8. لا تحدث إعادة المحاولة بنموذج آخر وفوترتها إلا إذا هيّأ التطبيق أو المنتج ذلك.
سيناريوهات التكلفة
جلسة بـ928 ألف توكن (800 ألف إدخال، و128 ألف إخراج — نداء واحد يستخدم كامل سقف أقصى إخراج): 800,000/مليون × 2$ + 128,000/مليون × 10$ = 1.60$ + 1.28$ = 2.88$ أثناء الفترة التمهيدية. ووجّه الجلسة نفسها عبر واجهة الدُّفعات فتهبط إلى 0.80$ + 0.64$ = 1.44$. من 1 سبتمبر تصبح الجلسة نفسها 4.32$ بالسعر القياسي.
أضِف التخزين: إن غطّى برومبت نظام ثابت أو لقطة مستودع 720 ألفًا من إجمالي 800 ألف إدخال (نجاح تخزين 90%)، يصبح طرف الإدخال أثناء الفترة التمهيدية 720,000/مليون × 0.20$ + 80,000/مليون × 2$ = 0.144$ + 0.16$ = 0.304$، ليصبح إجمالي الجلسة 0.304$ + 1.28$ = 1.58$ — انخفاض بنسبة 45% عن 2.88$ غير المخزّنة.
يوم استخدام نموذجي: فريق وكيل برمجة يشغّل 25 جلسة من هذه الجلسات البالغة 928 ألف توكن يوميًا يدفع 25 × 2.88$ = 72$/يوم بلا تخزين أثناء الفترة التمهيدية، أو 25 × 1.44$ = 36$/يوم عبر الدُّفعات. وعلى مقياس شهري أصغر — 20 مليون إدخال و5 ملايين إخراج — تكلفة Sonnet 5 هي 20 × 2$ + 5 × 10$ = 40$ + 50$ = 90$/شهر حتى 31 أغسطس. من 1 سبتمبر يصبح الحمل نفسه 135$/شهر، مطابقًا Sonnet 4.6؛ وOpus 4.8 هو 225$/شهر.
ملاءمة الاستخدام
مرشح لـ: مستخدمي Sonnet 4.6 الذين يقيّمون خطوة قدرة دون سعر Opus، وخطوط وكلاء البرمجة التي تستفيد من سقف إخراج 128 ألفًا، والفرق التي تريد اختبار ظهور فرق SWE-bench المنشور على مهامها.
قارن البدائل إن: ركز حملك على الاستدلال العلمي، أو كانت الحركة عالية الحجم وروتينية، أو حقق نموذج حالي آخر عتبة نجاحك بكلفة كلية أدنى. لا تغني فروق البنشماركات عن تقييم متكافئ للحمل.
قائمة القرار
قادمًا من Sonnet 4.6: شغّل أصعب تقييم مهام برمجة لديك على النموذجين معًا. إن ظهرت مكاسب Sonnet 5 على مستوى SWE-bench في نتائجك، فمن السهل تبرير زيادة السعر 33% استنادًا فقط إلى سقف الإخراج 128 ألف.
بالمقارنة مع Opus 4.8: إن كانت مهامّك ذات طابع برمجي غالب، فـ Sonnet 5 أرخص وأعلى نتيجة على SWE-bench Verified معًا. وإن كانت ثقيلة الاستدلال بمعنى GPQA، فإنّ نتيجة Opus 4.8 البالغة 93.6% ما زالت تشتري شيئًا لا يضاهيه Sonnet 5.