قبل ثلاثة أسابيع، كانت بنية Anthropic من فئة Mythos تعيش في مكان واحد بالضبط: Claude Fable 5، بسعر $10 لكل مليون رمز إدخال و$50 للإخراج لأصعب أعمال البرمجة الوكيلية. والسؤال المفتوح كان هل ستنزل تلك البنية يوماً في السعر، أم تبقى ترفاً حصرياً على النموذج الرائد.
في 1 يوليو، أجابت Anthropic. يعمل Claude Sonnet 5 على بنية فئة Mythos نفسها، ويطلق بسعر $2 لكل مليون رمز إدخال و$10 للإخراج حتى 31 أغسطس، ثم يستقر عند $3/$15 من 1 سبتمبر — ليس "Sonnet 4.7" جديداً، بل نموذجاً ثانياً مبنياً على أساس Fable 5.
بنية واحدة، طبقتان
يطلق Sonnet 5 دون سعر Sonnet 4.6 مؤقتاً: $2 لكل مليون رمز إدخال و$10 للإخراج حتى 31 أغسطس 2026. من 1 سبتمبر ينتقل إلى $3/$15، مطابقاً Sonnet 4.6 ودون Opus 4.8 البالغ $5/$25. الإدخال المخزّن مؤقتاً يكلف $0.20 لكل مليون أثناء الفترة التمهيدية ثم $0.30 بعدها، وواجهة الدفعات (Batch) تخصم 50% من الاتجاهين. يبقى السياق عند مليون رمز، مطابقاً لـ Sonnet 4.6 وOpus 4.8، لكن حد الإخراج يقفز إلى 128,000 رمز. معرّف الـAPI هو claude-sonnet-5، وحدّ التقاعد المبدئي الذي تضعه Anthropic ليس قبل 1 يوليو 2027.
تجلب البنية سمتين موروثتين إضافيتين. التفكير التكيفي مفعّل دائماً، بلا مفتاح تفكير موسّع يمكن قلبه — نفس السلوك الذي دشّنه Fable 5. وتنطبق مصنفات الأمان نفسها: ترجع الطلبات المصنفة في الأمن السيبراني الهجومي أو الأحياء والكيمياء أو التقطير برفض صريح. لا تحدث إعادة محاولة بنموذج آخر إلا إذا هيّأها التطبيق أو المنتج.
ماذا تقول المعايير
أبرز رقم في إعلان Anthropic هو SWE-bench Verified: يسجل Sonnet 5 نسبة 89.4% مقابل 88.6% لـClaude Opus 4.8. ويسجل 71.8% على SWE-bench Pro، اختبار البرمجة القائم على الوكلاء، و85.6% على Terminal-Bench 2.1.
في التفكير العلمي، يسجل GPQA Diamond نسبة 92.0% مقابل 93.6% لـOpus 4.8. وعلى ARC-AGI-2، يسجل Sonnet 5 نتيجة 20.0 مقابل 15.0 لـSonnet 4.6. أما Humanity's Last Exam بلا أدوات فنتيجته 42.5%. وتذكر بقية أرقام الإطلاق: LMSYS Arena عند 1435، وMMLU عند 93.8%، وHumanEval عند 96.0%، وMATH عند 93.5%.
اقرأ النمط بصدق: يغلق Sonnet 5 تقريباً كل فجوة البرمجة إلى Opus 4.8، بل يتجاوزه فعلياً على SWE-bench Verified، بينما يتنازل عن أرضية في معيار التفكير الأصعب. أثناء الفترة التمهيدية يفعل ذلك بسعر دون Sonnet 4.6؛ وبعد 1 سبتمبر يطابق سعر Sonnet القياسي.
Sonnet 5 مقابل Sonnet 4.6 مقابل Opus 4.8
| المواصفة | Claude Sonnet 5 | Claude Sonnet 4.6 | Claude Opus 4.8 |
|---|---|---|---|
| السعر (إدخال/إخراج لكل مليون) | $2 / $10 حتى 31 أغسطس؛ ثم $3 / $15 | $3 / $15 | $5 / $25 |
| نافذة السياق | 1M رمز | 1M رمز | 1M رمز |
| حد الإخراج | 128K | 64K | 128K |
| SWE-bench Verified | 89.4% | 79.6% | 88.6% |
| GPQA Diamond | 92.0% | 89.9% | 93.6% |
| وضع التفكير | تكيفي، مفعّل دائماً | قياسي | قياسي |
| القيود | طلبات السيبراني / الأحياء / التقطير المصنفة ترفض صراحةً | قياسية | قياسية |
هل تستحق ترقية الطبقة الوسطى؟
احسب على عبء عمل حقيقي قبل التبديل. وكيل برمجة يحرق 2M رمز إدخال و400K رمز إخراج يومياً يكلف نحو $8 على Sonnet 5 أثناء الفترة التمهيدية (2 × $2 + 0.4 × $10)، مقابل $12 على Sonnet 4.6 و$20 على Opus 4.8. من 1 سبتمبر، يصبح الحمل نفسه $12 على Sonnet 5، مطابقاً Sonnet 4.6 مع سقف إخراج أعلى ونتيجة برمجة أقوى. حاسبة التكلفة تفعلها لأحجامك الخاصة، وتفصيل أسعار Claude Sonnet 5 يغطي حسابات التخزين المؤقت والدفعات بالكامل.
حيث تستحق الترقية بوضوح: وكلاء البرمجة وحلقات الأدوات الطويلة التي كانت تصطدم بسقف الـ64K إخراج لدى Sonnet 4.6، لأن حد الإخراج 128K يعني ردوداً مبتورة أقل بكثير في منتصف المهمة. وحيث يصعب تبرير الترقية: أعباء العمل المرتاحة أصلاً على Sonnet 4.6 والتي لا تحتاج هامش الإخراج الإضافي أو قفزة البرمجة، خصوصاً بعد انتهاء السعر التمهيدي. وإذا كان عملك يعتمد على سقف تفكير Opus 4.8 بمستوى GPQA، فإن Sonnet 5 لا يغلق تلك الفجوة؛ يبقى Opus 4.8 الخيار.
أسبوع إطلاق مزدحم
لم يصدر Sonnet 5 في عزلة. في اليوم نفسه أُغلقت مراجعة ضوابط التصدير وأُعيد Claude Fable 5 لجميع العملاء، مع استعادة AWS الوصول على Bedrock. كان GPT-5.6 محصوراً بالشركاء حينها، ثم وصل إلى الإتاحة العامة في 9 يوليو. لا يغير ذلك حسابات Sonnet 5، لكنه يثبت التسلسل الحالي للإتاحة.