Claude Opus 4.7، مراجعة

البرمجة وتحليل المستندات الطويلة والقدرة متعددة اللغات. ما يعنيه ملف الأسعار والقدرات الموثّق لـ Opus 4.7 بشأن أعباء العمل التي يجب تكليفه بها.

من فريق benchr · · عرض سجل التغييرات · أرقام المزود لقطات مؤرخة؛ روجعت المنهجية في 23 يوليو 2026

benchr rating: 4.6 / 5

تكلفة المدخلات / 1M $5.00 لقطة سعر قائمة من Anthropic؛ تحقّق من السعر الحي
SWE-Bench Verified 87.6% مُبلَّغ من Anthropic على SWE-bench Verified؛ ليس ضمان إنتاج
سعة السياق 1M حد أقصى معلن من Anthropic؛ يجب اختبار الجودة الفعلية
تكلفة المخرجات / 1M $25 مقابل $15 لـ Sonnet 4.6

أعلنت Anthropic عن Claude Opus 4.7 في 16 أبريل 2026 وفق إعلان الإطلاق. تتعامل هذه المراجعة مع جدول الإطلاق والتوثيق والأسعار كأدلة من المزود؛ فهي تصف المنتج وتهيئة اختباره ولا تثبت أداءه أو تكلفته داخل نظام إنتاج بعينه.

يقرأ المقال الأدلة العامة: الإعلان وتوثيق Claude API ونتيجة SWE-bench Verified التي تنشرها Anthropic وصفحة الأسعار. ويحوّلها إلى فرضيات تقييم، لا إلى نتيجة أداء مستقلة من benchr أو توزيع عام لأعباء العمل.

إن كان عبؤك يتضمن كوداً إنتاجياً أو مستندات كثيفة أو أخطاء مكلفة، فأدرج Opus في مقارنة مضبوطة. أدرج مستوى أقل سعراً كخط أساس، وثبّت المطالبات والأدوات، ثم قرر بعد قياس نجاح المهمة ووقت المراجع والكمون واستخدام الرموز.

ما يقوله ملف القدرات الموثّق

تضع Anthropic Opus 4.7 حول البرمجة والاستدلال في الغموض وتحليل المستندات الطويلة. تستشهد موادها بنتيجة SWE-bench Verified يبلغ عنها المزود، وتصف حل المشكلات متعدد الخطوات، وتعلن سياقاً بمليون رمز. هذه مدخلات لاختيار حالات الاختبار؛ فلا يضمن معيار ولا سقف سياق إكمال مهمة إنتاجية.

زن هذه كادعاءات قدرات من المزود لا كتحقق مستقل. اختبر أي مرشح، بما فيه Opus، على مدخلاتك وأدواتك وقيود السلامة ومعايير القبول لديك قبل استنتاج القدرة أو القيمة.

البرمجة: اختبر هل يستحق فارق السعر

تبلغ Anthropic عن 87.6% لـOpus 4.7 على SWE-bench Verified في مادة الإصدار المذكورة. تعامل معها كنتيجة مزود تحت حزمة معيار محددة، لا كمعدل نجاح لمستودعك ولا كإثبات تفوق على نموذج أو إعداد آخر.

ينبغي لاختبار مستودع قابل للإعادة أن يأخذ عينات من إصلاح محدود وميزة عابرة للملفات واقتراح معماري وتغيير في مكتبة غير مألوفة. أعط كل مرشح حالة المستودع والمطالبة والأدوات والمهلة وميزانية الإعادة نفسها. سجّل اجتياز الاختبارات والتعديلات غير المصرح بها وواجهات API المخترعة ودقائق المراجعة والكمون والرموز الكلية.

ولتغيير آلي مثل إعادة تسمية متغير عبر عشرين ملفاً، قارن Sonnet وOpus على مجموعة القبول نفسها. يجعل السعر الأقل Sonnet خط أساس معقولاً، لكنه لا يثبت إكمال المهمة بصورة صحيحة.

HARD WORK ↑ COST SENSITIVE → Opus 4.7 production code · long docs Sonnet 4.6 daily driver · drafts · routine code Haiku 4.5 high-volume · classification
تموضع Anthropic لثلاثة مستويات Claude في لقطة مايو 2026. تعامل معه كتوجيه من المزود، وتحقق من الكتالوج الحي وملاءمة المهمة قبل النشر.

المستندات الطويلة: اختبر الاسترجاع والتلخيص منفصلين

تعلن Anthropic حداً أقصى للسياق يبلغ مليون رمز لـOpus 4.7. السعة ليست ضماناً للاسترجاع أو الاستشهاد أو جودة التلخيص. تعتمد الحدود الفعلية على بنية المستند وموضع الحقيقة وتصميم المطالبة والأدوات وعتبة الخطأ.

لاختبار سير مستند طويل، أنشئ مستندات بإجابات مرجعية وضع الحقائق قرب البداية والوسط والنهاية. قارن تلخيصاً بمرور واحد مع سير «استعلام ثم تلخيص» تحت ميزانية رموز واحدة. قِس دقة الحقائق المستشهد بها والفقد والادعاءات غير المدعومة ووقت المراجع. اعتمد المرورين فقط إن حسّنا هذه المقاييس على مستنداتك. يشرح دليل نوافذ السياق الفرق بين السقف المعلن والحد الفعلي للمهمة.

الحد الأقصى للسياق مواصفة سعة؛ ولا تزال جودة الاسترجاع والتلخيص بحاجة إلى اختبارين منفصلين.

للعمل طويل المستندات كالمراجعة القانونية أو تحليل السياسات، قارن النماذج على أطوال المستندات ومستوى المخاطر الفعلي. قد يحتاج الأصغر إلى تجزئة أو استرجاع، بينما تزيد النافذة الأكبر السعة المباشرة؛ ولا تثبت أي معمارية الدقة بلا إجابات مرجعية.

متعدد اللغات: اختبر اللهجة والسجل مباشرة

لا تثبت المعايير العامة متعددة اللغات ملاءمة اللهجة أو السجل لجمهور بعينه. تعامل مع الإنجليزية والعربية الخليجية والهندية المرومنة ونص السوق الإندونيسي كطبقات تقييم منفصلة بدلاً من استنتاجها من درجة واحدة.

أنشئ مراجعة معماة بمتحدثين أصليين ومطالبات ثابتة وسلم للوفاء الواقعي والقواعد واللهجة والرسمية ووقت التحرير. استخدم أمثلة كافية من كل سوق لكشف التباين، وانشر العينة والسلم مع أي استنتاج. لبروتوكول عربي راجع دليل تقييم المحتوى العربي.

فرضيات فشل يجب اختبارها قبل النشر

الحكايات المجتمعية ليست معدل فشل مقاساً. ما يلي فرضيات لمجموعة ما قبل النشر، لا ادعاءات بأن Opus يظهرها بتكرار معلوم.

الفرضية الأولى: ضبط طول المخرج. شغّل أسئلة نعم/لا ثابتة مع قيد «سطر واحد» وبدونه، وقِس اتباع التعليمات والدقة والرموز؛ لا تفترض أن تعديل مطالبة واحداً يعمل عبر كل الاستدعاءات.

الفرضية الثانية: اختراع تواقيع API. خذ عينات من مكتبات قياسية وأقل شيوعاً وثبّت إصدار كل مكتبة وافحص كل رمز مولد مقابل الوثائق الرسمية أو المترجم. أبلغ معدل الاختراع والامتناع لكل مجموعة.

الفرضية الثالثة: انجراف النطاق في إعادة الهيكلة. عرّف قائمة ملفات ورموز مسموحة، وشغّل مهام متطابقة، واحسب التعديلات خارج النطاق. قارن قيد نطاق صريحاً بمطالبة الأساس قبل اختيار حارس إنتاج.

ما يكلّفه

في لقطة الأسعار المستخدمة هنا، أدرجت Anthropic ‏$5 لكل مليون رمز مدخل و$25 لكل مليون مخرج، مع معدل أقل للمدخلات المخزنة. هذه أسعار قائمة من المزود لا عرض سعر ولا توقعاً لتكلفة الإنتاج الكلية. تحقق من صفحة السعر الحية وأدخل الإعادات واستدعاءات الأدوات والتخزين المؤقت وعمل المراجعة.

مرجع الأسعار الرسمية، مايو 2026 — عائلة Anthropic Claude
المستوىالمدخلات / 1Mالمخرجات / 1Mملاءمة العمل
Opus 4.7$5.00$25الكود الإنتاجي، العمل على المستندات الطويلة، التفكير المنطقي الصعب
Sonnet 4.6$3.00$15خيار الاستخدام اليومي: المسودات والمحادثة والكود الروتيني
Haiku 4.5$1.00$5الحجم العالي، التصنيف، الاستخراج

حوّل قرار المستوى إلى قاعدة قابلة للقياس: عرّف عتبات لنجاح المهمة والخطأ ووقت المراجعة والكمون، ثم اختر أقل مستوى سعراً يجتازها. أعد الاختبار عند تغير إصدار النموذج أو المطالبة أو الأدوات؛ ولا تفترض نمط استخدام الفرق الأخرى أو أن نقل الحركة إلى مستوى بعينه سيحسن القيمة.

1.67× سعر مدخلات Opus 4.7 مقابل Sonnet 4.6. الفجوة في المخرجات أوسع.

لمقارنة Opus مع GPT أو Sonnet، ثبّت المهمة والمطالبة والأدوات وميزانية الإعادة وسلّم القبول. لا تثبت درجات المزودين ترتيباً إنتاجياً موحداً، كما لا يثبت سعر الرمز أن الاشتراك في نموذجين أو التوجيه بينهما هو الأرخص. يقدم دليل المقارنة عوامل قرار عامة، وتوضح مقالة السعر بحسب حالة الاستخدام ما يجب إدخاله في حساب التكلفة.

الحكم

Opus 4.7 مرشح للأعمال التقنية والمستندات الطويلة حين تتوافق مواصفات المزود مع احتياجك، لكنه ليس افتراضياً مثبتاً. شغّل اختبار قبول مقابل Sonnet وبدائل حالية، وادفع علاوة القائمة فقط إذا خفضت الأخطاء أو وقت المراجعة أو التكلفة الكلية بصورة مقاسة.

قد يستخدم نظام إنتاج مستوى واحداً أو عدة مستويات أو توجيهاً بينها. حدد ذلك من قياساتك ومن بساطة التشغيل ومخاطر التوجيه، لا من شكل صفحة الأسعار أو توقع عائد غير مقاس.

الأسئلة الشائعة

هل Claude Opus 4.7 يستحق $5 لكل مليون رمز مدخل؟

لا توجد إجابة عامة بنعم أو لا. أدرجت Anthropic ‏Opus 4.7 عند $5 لكل مليون إدخال وأبلغت عن 87.6% على SWE-bench Verified في لقطة المصادر، لكن المعيار لا يثبت العائد على عبئك. شغّل المهام الممثلة نفسها على Opus وSonnet بمراجعة معماة، وادفع العلاوة فقط إذا برر فرق الجودة أو تكلفة الخطأ ذلك.

كيف يقارن Claude Opus 4.7 بـ GPT-5؟

لا تكفي الدرجات المنشورة وتموضع المزود لتسمية فائز عام. قارن النموذجين على المهام والمطالبات ذات الإصدارات نفسها، وسجّل نجاح المهمة والأخطاء الواقعية أو البرمجية والكمون والرموز والتكلفة. معايير المزودين دليل بداية لا ضمان إنتاج.

ما تكلفة Claude Opus 4.7؟

في لقطة تسعير المزود المستخدمة هنا، أدرجت Anthropic ‏$5 لكل مليون مدخل و$25 لكل مليون مخرج، مع معدل أقل للمدخلات المخزنة. قد يتغير السعر؛ فتحقق من الصفحة الحية واحسب من أحجام الإدخال والإخراج والتخزين المقاسة.

متى يجب استخدام Sonnet 4.6 بدلاً من Opus 4.7؟

تعامل مع Sonnet كمرشح أقل سعراً للعمل المتكرر الأقل خطراً، لكن لا تفترض كفايته من اسم المهمة وحده. أنشئ مجموعة ممثلة وحدد عتبات مقبولة للخطأ ووقت المراجعة، واختر أقل مستوى سعراً يجتازها.

ما هي سعة السياق الفعلية لـ Claude Opus 4.7؟

أعلنت Anthropic حداً أقصى بمليون رمز. لا تضمن السعة جودة الاسترجاع أو التلخيص. اختبر مستندات بأطوال ومواضع حقائق مختلفة، ثم قِس صحة الإحالات والحقائق المفقودة والادعاءات غير المدعومة وفقد التلخيص قبل تحديد حد الإنتاج.

سجل التغييرات

  • 23 يوليو 2026 — استُبدلت الحكايات السلوكية وأحكام المستوى والتوجيه والعائد العامة ببروتوكولات تقييم قابلة للإعادة، ووُسمت معايير المزود والسياق والأسعار كلقطات لا ضمانات إنتاج.
  • 25 مايو 2026 — أُعيد كتابة الأقسام التي كانت تُروي اختبارات المختبر الأصلية؛ المقال الآن يُرسّخ حكمه في معايير الأداء المنشورة والأسعار وتحديد موقع Anthropic. الأسعار مُتحقَّق منها مقابل التوثيق الحالي للمزوّد.
  • 4 مايو 2026 — أُضيف قسم مقارنة Sonnet 4.6 بعد أن طلب القراء حساب المستويات المتقاطعة.
  • 22 أبريل 2026 — نُشر أصلاً.

المراجع

  1. Anthropic، "توثيق Claude API"، docs.claude.com، وصول مايو 2026.
  2. Anthropic، "Claude Pricing"، anthropic.com/pricing، وصول مايو 2026.
  3. LMSYS، "Chatbot Arena leaderboard"، lmarena.ai، لقطة مايو 2026.
  4. "SWE-bench Verified leaderboard"، swebench.com، مايو 2026.
  5. Anthropic، "Introducing Claude Opus 4.7"، anthropic.com/news/claude-opus-4-7، 16 أبريل 2026.