أُعيدت قراءة كل صفحة توصي بنموذج ومقارنتها بالسجل. صارت توصيات Claude تبدأ من Claude Opus 5 وClaude Sonnet 5 بدل Opus 4.8 وSonnet 4.6، وتوصيات OpenAI من عائلة GPT-5.6 وGPT-6 Astra، وتوصيات Google من Gemini 3.8 Flash إلى جانب Gemini 3.1 Pro. تحتفظ مراجعات النماذج المتجاوَزة بأحكامها وأرقامها بوصفها سجلًا لتاريخها، وأُضيفت إليها ملاحظة مؤرخة تسمّي بديلها. وأُعيدت قراءة حقائق التطبيقات من المزوّدين: ChatGPT في خطتي Free وGo يعمل افتراضيًا بنموذج GPT-5.6 Luna، وClaude في Free وPro بنموذج Claude Sonnet 5، وأعادت Google عرضها الطلابي، وصار NotebookLM باسم Gemini Notebook. وأوقفت DeepSeek نموذجي V4-Flash وV4-Flash-Vision-Exp في 10 سبتمبر وحلّ محلهما DeepSeek-V4.1-Flash المسجَّل في دفتر دورة الحياة. وعاد GLM-5.3-Flash إلى سعره المعلن $0.15 / $0.50 بعد انتهاء عرضه الترويجي في 9 سبتمبر. ولم تعد لوحات الترتيب وأداة الترشيح تعرض النماذج المتقاعدة، وصُحّح ترتيب نماذج البرمجة مفتوحة الأوزان — راجع التصحيحات.
سجل تغييرات benchr
كل تحديث على بيانات benchr — نماذج جديدة تُضاف، أسعار يُتحقَّق منها، إيقافات تُتابَع، تغيّرات في منهجية التقييم. كل مدخلة مؤرّخة ومرتبطة بالمصدر الرسمي. سجل النسخ الخام يعيش في history.json.
أُضيف السجلان المتحققان claude-fable-5-1 وclaude-mythos-5-1 إلى دفتر الحقائق، وأُضيف Fable 5.1 إلى طبقة النماذج التفاعلية، والخط الزمني لإصدار سبتمبر، والأسعار وصفحات المزوّد ومعرّفات API والبحث وخريطة الموقع والصفحات التحريرية الثنائية. تسجل Anthropic لكليهما سياق 1M وإخراجاً أقصى 128K واستدلالاً تكيفياً وسعر 10/50 دولاراً للإدخال/الإخراج القياسي لكل مليون، و0.25 دولار لقراءة الكاش، و5/25 دولاراً للدفعات. Fable متاح عموماً عبر Anthropic ومسارات الشركاء المدعومة؛ بينما يبقى Mythos مقيداً بوصول Project Glasswing المدقق. ويوثق دليل الترحيل تغييرات تكسر العقد: اختيار أداة مسمى أو إجباري، وضبط التفكير اليدوي، وملء المساعد مسبقاً مرفوضة. وتظهر أرقام البنشمارك المنسوبة إلى المزود بوصفها كذلك لا كقياس من benchr. الإصدار الرسمي.
جرى خطّا تحديث متوازيان في أغسطس وصارا الآن سجلًا واحدًا: جولة 21 أغسطس التي أضافت Gemini 3.7 Flash وGrok 4.6 وGLM-5.3 وKimi K3، وجولتا 24–28 أغسطس اللتان سجّلتا خفضي GPT-5.6 Sol وGemini 3.6 Flash وانتقال DeepSeek إلى تسعير الذروة من 16 أغسطس. وأُعيدت قراءة كل رقم متنازع عليه من صفحة المزوّد في 31 أغسطس: تأكدت أسعار Kimi K3 (3$/0.30$/15$)، وصُحّح تاريخ إصدار GLM-5.3 إلى 18 أغسطس، وصارت وثائق Moonshot تسم Kimi K2.5 وسلسلة Moonshot V1 متقاعدتين اليوم والنداءات تعيد 404 — والمتتبّع والسجل الدائم يعكسان ذلك. وبشكل منفصل، صارت صفحة أسعار Anthropic تدرج سعر إطلاق Claude Sonnet 5 البالغ $2/$10 سعرًا قياسيًا — ولن تحدث زيادة 1 سبتمبر إلى $3/$15.
استبدلت DeepSeek التسعير الثابت بسعري ذروة وخارج ذروة عند الساعة 16:00 بالتوقيت العالمي من 16 أغسطس 2026، وهو تغيير لم تلتقطه جولة 24 أغسطس. ساعات الذروة هي 01:00–04:00 و06:00–10:00 بالتوقيت العالمي من الاثنين إلى الجمعة، وكل ساعة أخرى بنصف السعر. انتقل V4-Flash من 0.14$/0.28$ ثابتة لكل مليون توكن إلى 0.44$/1.32$ في الذروة و0.22$/0.66$ خارجها، وانتقل V4-Pro من 0.435$/0.87$ إلى 1.32$/3.96$ و0.66$/1.98$. وأشد ارتفاع كان في الإدخال المخزّن مؤقتًا: نحو اثني عشر ضعفًا في V4-Pro داخل الذروة. كلا التغييرين مسجّل في history.json، وأُعيد تسعير كل صفحة وترتيب ومقارنة ومقال يعتمد عليهما بالعربية والإنجليزية. ونُشر تحليل لما يكلّفه هذا الجدول الزمني باللغتين.
أُضيفت ثلاثة نماذج لم تكن في السجل: GLM-5.3 (من Z.ai في 18 أغسطس بسعر 1.4$/4.4$، ويستخدم النموذج الأساس نفسه الذي في GLM-5.2 مع تحسينات بعد التدريب)، وGLM-5.3-Flash (في 26 أغسطس، نموذج MoE متعدد الوسائط أصلًا بـ320 مليار معامل و18 مليارًا نشطة برخصة MIT، بسعر مدرج 0.15$/0.50$ وعرض إطلاق ينصّفه حتى 9 سبتمبر 2026)، وDeepSeek-V4-Flash-Vision-Exp (في 21 أغسطس، تجريبي وبسعر V4-Flash نفسه). الثلاثة في السجل الموثّق فقط ولم يدخل أي منها طبقة الأدوات التي تغذّي الترتيبات، لأن نموذجًا بهذه الحداثة لا سجل قدرة له لدى benchr.
سجل دورة الحياة: أُوقفت واجهة Assistants لدى OpenAI في 26 أغسطس 2026 وصارت تظهر ضمن قسم الإيقافات السابقة في الصفحة الرسمية، فتحوّلت المدخلة من «مهملة» إلى «متقاعدة». ومسار الترحيل الذي تسمّيه OpenAI هو واجهتا Responses وConversations. ولم يمر أي موعد إيقاف آخر متتبَّع؛ ولا يزال gemini-robotics-er-1.6-preview من Google مقررًا في 31 أغسطس.
فُحص ولم يتغيّر: لم تنشر Anthropic ولا OpenAI ولا Google ولا xAI ولا Mistral أي تغيير في نموذج أو سعر بين 24 و28 أغسطس 2026.
خفّضت OpenAI سعر GPT-5.6 Sol في 21 أغسطس من 5$/30$ إلى 4$/20$ لكل مليون توكن، ونزل الإدخال المخزّن من 0.50$ إلى 0.40$. وتصف صفحة التغييرات السعر بأنه ترويجي حتى 21 نوفمبر 2026 على الأقل. وجدول أسعار Google صار يعرض Gemini 3.6 Flash عند 0.75$/3.75$ حتى 31 ديسمبر 2026، أي نصف 1.50$/7.50$ المسجّل في 22 يوليو. كلا التغييرين مسجّل في history.json.
أُضيف نموذجان لم يكونا في السجل: Gemini 3.7 Flash، المتاح عمومًا في 13 أغسطس بالسعر نفسه الذي عند 3.6 Flash وبلا جدول بنشمارك منشور، وGrok 4.6، المُعلن في 12 أغسطس بسعة سياق 500 ألف توكن وسعر 2$/6$ لكل مليون تحت 200 ألف توكن. ونُشر تحليل لتطابق سعرَي Flash ولعودة السعر الكامل في 1 يناير 2027، بالعربية والإنجليزية.
في سجل دورة الحياة: صار gpt-5.2-chat-latest وgpt-5.3-chat-latest ضمن قسم التقاعدات السابقة عند OpenAI، ومرّ موعد إيقاف embedding-2-preview من Google، فتحوّل السجلان من «مُهمل» إلى «متقاعد». وأُضيفت أربعة سجلات لم تكن في المجموعة: إهمال OpenAI في 20 يوليو لتسعة معرّفات صوت وزمن حقيقي وتفريغ (الإزالة في 20 يناير 2027)، وإيقاف Google لنماذج Imagen 4.0 في 17 أغسطس، وإيقافها gemini-robotics-er-1.6-preview في 31 أغسطس، وتقاعد Anthropic لواجهة أدوات البرومبت التجريبية ومعها Workbench في 17 أغسطس. كما صار المتتبّع يحمل موعد Assistants API في 26 أغسطس 2026 بعدما كان غائبًا عنه.
أضاف مسح سوقي من المصادر الرسمية Gemini 3.7 Flash وGrok 4.6 وGLM-5.3 وKimi K3 إلى سجل الحقائق وأدوات الاختيار والمقارنة والتحليل الثنائي ومراجع السعر والأرشيف والتسلسل الزمني والبحث والخلاصات وخريطة الموقع. أُعيد التحقق من الأسعار والتخزين والسياق والإخراج ومعرّفات API والاستدلال والوسائط والأدوات والتوفر ونسخ المعايير.
تسجل BenchR الحدود المؤرخة والناقصة بلا تسطيح: ينتهي سعر Gemini التمهيدي بعد 31 ديسمبر؛ لا تنشر xAI سقف إخراج نصي رقمياً لـGrok؛ أوزان GLM معلنة لكنها خلف بوابة تقوية أمان؛ ويفصل سجل Kimi بين عقد API والأوزان. لم يُضف Astra من OpenAI حينها لأنه أُعلن ولم يصدر؛ وقد صدر باسم GPT-6 Astra في 3 سبتمبر 2026 وصار مسجّلاً.
يعرض جدول إيقافات Gemini API الحالي من Google الآن embedding-2-preview كمتوقف، فنقله benchr إلى السجل الدائم كمتقاعد. وأُضيفت imagen-4.0-generate-001 وimagen-4.0-ultra-generate-001 وimagen-4.0-fast-generate-001 مع أبكر موعد إيقاف في 17 أغسطس وبديل gemini-3.1-flash-image المدرج من المزوّد.
يبقى سجل OpenAI المؤرخ في 10 أغسطس للقطتي gpt-5.2-chat-latest وgpt-5.3-chat-latest «قيد الإيقاف» لا «متقاعداً»: فما زالت صفحة الإيقافات الحالية تعرض إشعار 8 مايو من دون تأكيد صريح للحالة الماضية.
أُعيد التحقق من تقاعد اسمي deepseek-chat وdeepseek-reasoner في 24 يوليو، ثم نُشرت قائمة ترحيل عملية. وتربطها الآن سجلات دورة الحياة والأرشيف والمتتبّع والمراجعة.
أُضيف خطأ Google Gemini permission_denied (403) إلى مرجع الأخطاء اعتماداً على توثيق Google، وسُجّل gemini-robotics-er-2-preview في سجل حقائق النماذج. تنشر Google معرّف API ووصف الروبوتات، لكنها لا تنشر سعراً أو حد سياق أو تاريخ إطلاق تستخدمه benchr، لذا تظل هذه الحقول فارغة.
نُشر تحليل OpenAI Presence بالعربية والإنجليزية اعتمادًا على إعلان OpenAI بتاريخ 22 يوليو، وصفحة بيانات الشركات، ووثائق ضوابط بيانات API. يفصل المقال أرقام المزوّد عن الدليل المستقل، ويسجل غياب السعر العام والتسجيل الذاتي، ويقدم قائمة شراء وتجربة.
أُضيفت مهارة تشغيل محلية للمشروع، وصُححت تعليمات قديمة تخص أعداد الصفحات والنماذج وبطاقات المشاركة العربية وتحميل AdSense وSchema الأدوات والفرق بين سؤال اكتشاف فقط وطلب تحديث وبناء ونشر مصرح به مسبقًا.
أُضيف Claude Opus 5 إلى model-figures.json وmodels.json بعد التحقق من إطلاقه في 24 يوليو. تسجّل وثائق Anthropic الحالية معرّف API claude-opus-5، وسعر 5/25 دولاراً لكل مليون توكن، وسياق مليون توكن، وأقصى إخراج 128 ألفاً.
وأُضيف Gemini 3.5 Flash-Lite إلى طبقة المقارنة النصية بسعر 0.30/2.50 دولار وسياق مليون توكن وحد إخراج 64 ألفاً.
يشمل سجل الحقائق أيضاً GPT-Realtime-2.1 وmini، وGPT-Live-1 وmini، وGemini 3.1 Flash TTS Preview، وGemma 4 26B A4B IT وGemma 4 31B IT، وLeanstral 1.5، وQwen-Audio 3.0 TTS Plus وFlash، وMuse Image وMuse Video Preview. عندما لا ينشر المزوّد سعراً أو حدّاً أو بنشمارك أو معرّف API، يبقى الحقل فارغاً بدلاً من التخمين.
أُضيفت ستة سجلات موثّقة بمصادر رسمية إلى model-figures.json: Grok 4.5 من xAI، وGLM-5.2 من Z.AI، وMiniMax M3، وMeta Muse Spark 1.1، وGemini Omni Flash Preview، وGemini 3.1 Flash Lite Image. طبقة الترتيب في الأداة تضم الآن النماذج النصية الثلاثة ذات التسعير الرسمي: Grok 4.5 وGLM-5.2 وMiniMax M3. أما نموذج Meta المعاين ونماذج Google الإعلامية فتبقى في ملف الأرقام المفتوح لأنها لا تطابق جدول ترتيب المحادثة/البرمجة مباشرة. صفحات التسعير الجديدة: Grok 4.5 وGLM-5.2 وMiniMax M3.
سحب Gemini 3.5 Pro. ادّعاء 30 يونيو 2026 بأن Google أطلقت Gemini 3.5 Pro كان ملفَّقاً: كلا الرابطين المصدرَين الأصليَّين يُعيدان الآن خطأ 404، وتوثيق Google لتسعير ونماذج Gemini API ما زال يذكر Gemini 3.1 Pro بصفته الرائد الحالي، وتُدرج صفحة نماذج Google DeepMind "Gemini 3.5 Pro" ضمن القادم قريباً لا ضمن المُطلَق. سُحبت المراجعة وصفحة التسعير واستُبدلتا بإشعاري تصحيح في articles/gemini-3-5-pro-review وpricing/gemini-3-5-pro؛ وصُحِّحت أو حُذفت كل إشارة أخرى إليه في الموقع.
تصحيح توقيت توفّر GPT-5.6. كان ادعاء بلوغه التوفر العام في 1 يوليو خاطئاً عند التحقق في 8 يوليو، إذ بقي في معاينة مختارة. ثم أكدت OpenAI الإصدار الفعلي للـAPI في 9 يوليو 2026؛ فالحالة الحالية GA، وتحفظ الصفحات التاريخين بوضوح.
تصحيح أقصى إخراج Claude Sonnet 5 من 200,000 إلى 128,000 توكن. الرقم الصحيح يطابق Claude Opus 4.8 وهو ضعف حد Sonnet 4.6 البالغ 64,000. صُحِّح في البيانات وصفحتي الإطلاق والتسعير والمقارنات.
إيقاف جديد: أسماء DeepSeek القديمة deepseek-chat وdeepseek-reasoner. وفق api-docs.deepseek.com، تتقاعد هذه الأسماء القديمة في 24 يوليو 2026 لصالح الأسماء المُرقَّمة الصريحة (DeepSeek V4-Flash / V4-Pro) — مجرّد إعادة تسمية دون أي تغيير في السعر أو القدرات. أُضيف إلى deprecations.json وهب الإيقافات والمتتبّع.
التفاصيل الكاملة للتصحيحات الثلاثة مُسجَّلة في /corrections.
صُحّح تسعير Claude Sonnet 5 في model-figures.json وmodels.json وhistory.json وصفحات Sonnet 5 الإنجليزية والعربية. السعر الرسمي من Anthropic هو 2$ إدخال و10$ إخراج لكل مليون حتى 31 أغسطس 2026، ثم 3$/15$ من 1 سبتمبر. كانت مدخلة benchr المنشورة في 1 يوليو قد سجّلت 4$/20$ خطأً.
حدّثت OpenAI بطاقة نظام معاينة GPT-5.6 في 1 يوليو 2026 بنتائج معايير جديدة ومواصفات مؤكَّدة، من دون أي تغيير في الوصول. بقيت Sol وTerra وLuna محصورة في المعاينة الحكومية نفسها لنحو 20 شريكاً، والتي بدأت في 26 يونيو.
أصبح Sol، النموذج الرائد، مدخلة benchr القياسية في models.json بالمعرّف gpt-5-6. سعره 5/30 دولاراً لكل مليون توكن إدخال/إخراج، وسعر الإدخال المخزَّن 0.50 دولار، وسعر الدفعة 2.50/15 دولاراً. سعة السياق 1,050,000 توكن، وأقصى إخراج 128,000، ومعرّف API هو gpt-5.6-sol.
أضافت بطاقة النظام نتيجة 89.8% على SWE-bench Verified، مقابل 91.0% لـClaude Fable 5، و91.2% على GPQA Diamond، مقابل 93.6% لـClaude Opus 4.8. وظلت نتيجة Terminal-Bench 2.1 عند 88.8%، أو 91.9% في وضع ultra، كما كانت في المعاينة.
سُجّلت حقول Terra المؤكَّدة في model-figures.json: 2.50 دولار للإدخال و15 دولاراً للإخراج، و0.25 دولار للإدخال المخزَّن، و1.25/7.50 دولاراً للدفعات. سعة السياق مليون توكن، وأقصى إخراج 128,000، ومعرّف API هو gpt-5.6-terra. ونتيجتاه المنشورتان 85.2% على SWE-bench Verified و88.0% على GPQA Diamond.
أما Luna فسعره دولار واحد للإدخال و6 دولارات للإخراج، و0.10 دولار للإدخال المخزَّن، و0.50/3.00 دولار للدفعات. سعة السياق 1,050,000 توكن، وأقصى إخراج 128,000، ومعرّف API هو gpt-5.6-luna. ونتيجتاه المنشورتان 79.8% على SWE-bench Verified و82.0% على GPQA Diamond.
تصحيح 8 يوليو 2026: وصفت هذه المدخلة التحديث في الأصل بأنه وصول إلى الإتاحة العامة، وكان ذلك خطأً؛ راجع مدخلة 8 يوليو 2026 أعلاه. حُدِّثت تغطية الإطلاق وصفحة التسعير لتعكسا وضع المعاينة المُصحَّح.
تصحيح 8 يوليو 2026: أضافت هذه المدخلة في الأصل نموذجاً باسم "Gemini 3.5 Pro" لم تُطلقه Google قط — كان الادّعاء ملفَّقاً، وسُحبت الإضافة. راجع مدخلة 8 يوليو 2026 أعلاه و/corrections للتفاصيل الكاملة.
Claude Sonnet 5 (صدر في 1 يوليو 2026) — أضيف بسياق مليون توكن وأقصى إخراج 128,000، مطابق لـOpus 4.8 وضعف حد Sonnet 4.6 البالغ 64,000. نتائج المعايير المذكورة منسوبة إلى المزود. تصحيح 3 يوليو: السعر الرسمي 2$/10$ حتى 31 أغسطس، ثم 3$/15$ من 1 سبتمبر؛ كانت مدخلة 4$/20$ السابقة خطأً.
أُغلقت في 1 يوليو 2026 مراجعة ضوابط التصدير التي علّقت Claude Fable 5 لجميع العملاء منذ 12 يونيو: رفعت وزارة التجارة التعليق واستعادت AWS الوصول على Bedrock بالتزامن، في اليوم نفسه الذي أطلقت فيه Anthropic نموذج Claude Sonnet 5. أما Claude Mythos 5 فيبقى مقصوراً على مشروع Glasswing كما كان — غير متأثر بهذه الاستعادة. لا تغييرات في السعر أو المواصفات: 10/50 دولاراً لكل مليون، سياق مليون توكن، أقصى إخراج 128K، كلها بلا تغيير. سُجِّل كملاحظة توفّر مؤرّخة على مدخلة Fable 5 في model-figures.json؛ وحُدِّثت تغطية الإطلاق.
في 26 يونيو 2026 بدأت OpenAI معاينة محدودة لثلاثة نماذج من GPT-5.6: Sol، النموذج الرائد؛ وTerra، من فئة GPT-5.5 بنحو نصف السعر؛ وLuna، الأرخص والأسرع. وأضافت وضعَي استدلال جديدين هما max وultra.
كان الوصول مقصوراً على نحو 20 شريكاً موثوقاً ومعتمداً من الحكومة الأمريكية عبر API وCodex، مع تخطيط للإتاحة العامة «في الأسابيع المقبلة».
الأسعار المعلنة لكل مليون توكن كانت 5/30 دولاراً لـSol، و2.50/15 دولاراً لـTerra، و1/6 دولارات لـLuna. سُجّلت في model-figures.json مع تحفّظ واضح: مصدرها إعلان المعاينة من OpenAI ومركز المساعدة، لكنها لم تكن ظاهرة حتى 28 يونيو في صفحة تسعير developers.openai.com القابلة للقراءة آلياً، التي كانت لا تزال تدرج 5.5 و5.4. كما لم تكن سعة السياق والحد الأقصى للإخراج ومعرّفات API الدقيقة منشورة.
أُضيفت تغطية إطلاق GPT-5.6 وصفحة التسعير. وأُبقيت النماذج خارج أداة الترتيب التفاعلية في ذلك الوقت لغياب قياسات رسمية تصلح للتقييم، وهو المعيار نفسه الذي طُبّق على Kimi K2.7-Code.
خُفِّف تعليق ضوابط التصدير الأمريكي الصادر في 12 يونيو على نماذج فئة Mythos من Anthropic في 26 يونيو: أجازت وزارة التجارة إعادة نشر Claude Mythos 5 لمجموعة محدَّدة من مؤسّسات البنية التحتية الحيوية الأمريكية — إعادة إطلاق محدودة ضمن مشروع Glasswing، لا توفّراً عاماً. أما Claude Fable 5، النموذج المتاح عموماً، فيبقى معلَّقاً بالكامل لجميع العملاء؛ لم تشمله الإجازة، وسعره المُدرَج 10/50 دولاراً لم يتغيّر. والأمر التنفيذي نفسه الصادر في 2 يونيو بشأن «النماذج المتقدّمة المشمولة» هو خلفية إطلاق OpenAI لـ GPT-5.6 المقيَّد حكومياً. سُجِّل على مدخلتَي Fable 5 وMythos 5 في model-figures.json؛ والخلفية في شرح ضوابط التصدير.
بلغ نموذجا معاينة الصور موعد إغلاقهما 25 يونيو 2026 — وأُعيد تأكيده على جدول إيقافات Gemini الرسمي من Google. قُلِبت حالتهما من «مُهمَل» إلى «متقاعد» في deprecations.json (ونقلهما هب الإيقافات إلى السجل المتقاعد)؛ انتقِل إلى النسختين العامّتين gemini-3-pro-image وgemini-3.1-flash-image. وما زال مرتقباً: تقاعُد Claude Mythos Preview في 30 يونيو 2026.
أُضيفت إلى model-figures.json نماذج Mistral OCR 4، بسعر 4/2/5 دولارات لكل 1000 صفحة، وMistral Small 4، بسعر 0.15/0.60 دولار وبنية MoE 119B/6B وسياق 256K. وأُضيف Qwen3.7-Max المستضاف بسعر 2.50/7.50 دولاراً، وGrok Build 0.1 للبرمجة الوكيلية بسعر 1.00/2.00 دولار وسياق 256K، وQwen-AgentWorld 35B-A3B مفتوح الأوزان.
في الجولة نفسها، أصبح لـQwen3.7-Plus وQwen3.6-Plus سعر رسمي لكل توكن على Alibaba Cloud Model Studio، بدلاً من قيمة «غير منشور» السابقة. تتدرج الأسعار إلى 0.4–1.2 / 1.6–4.8 دولار و0.5–2 / 3–6 دولارات على التوالي.
كما أصبحت وثائق docs.x.ai تدرج Grok 4.20 بسعر 1.25/2.50 دولار عند سياق مليون توكن، بدلاً من رقم الإطلاق 2/6 دولارات عند سياق مليونين. ولم يتغير أي سعر تجاري لدى مزوّد آخر في المتابعة منذ 23 يونيو.
مرّ موعد إغلاقهما 15 يونيو 2026 — وأُعيد تأكيده على جدول إيقافات Anthropic الرسمي. استدعاءات claude-sonnet-4-20250514 وclaude-opus-4-20250514 تفشل الآن. قُلِبت حالتهما من «مُهمَل» إلى «متقاعد» في deprecations.json؛ ونقلهما هب الإيقافات إلى السجل المتقاعد، وصارت صفحتا الانتقال Sonnet 4 وOpus 4 سارية المفعول. ويبقى Opus 4.1 مُهمَلاً حتى 5 أغسطس 2026.
في 12 يونيو، توجيه ضوابط تصدير من وزارة التجارة الأمريكية منع استخدام نماذج فئة Mythos من أي شخص أجنبي، فعلّقت Anthropic نموذجي Claude Fable 5 وClaude Mythos 5 لجميع العملاء؛ وسحبت AWS الوصول على Bedrock في اليوم نفسه. بقية نماذج Claude غير متأثرة. الأسعار والمواصفات المُدرَجة لم تتغيّر في model-figures.json (أُضيفت ملاحظة توفّر مؤرّخة)؛ وتعترض Anthropic على الاستدعاء وتقول إنها تعمل على استعادة الوصول. حُدِّثت التغطية على Claude Mythos وإطلاق Fable 5، إضافةً إلى صفحات تسعير ومقارنة واختيار Fable 5.
مرجع /errors الجديد: 15 خطأً شائعاً في API الذكاء الاصطناعي عبر OpenAI وAnthropic وGemini، كل واحد مُتحقَّق منه مقابل وثائق الأخطاء الرسمية للمزوّد، مع الأسباب وإصلاحات الكود وجسور الانتقال إلى سجل الإيقافات وصفحات التسعير. مجموعة بيانات مهيكلة في api-errors.json؛ والمدقّق في scripts/generate_error_pages.py.
أُعيدت قراءة كل سعر تجاري متتبَّع حيّاً مقابل صفحة تسعير المزوّد نفسه — لا تغييرات في الأسعار منذ 10 يونيو (Anthropic، OpenAI، Google، xAI، DeepSeek، Moonshot، Mistral). صفحة تسعير Anthropic تنشر الآن أسعار إصابة التخزين المؤقت لكل نموذج، مما يسدّ ثغرات كانت معلنة سابقاً في model-figures.json: Opus 4.8/4.7 بـ 0.50 دولار، Sonnet 4.6 بـ 0.30 دولار، Haiku 4.5 بـ 0.10 دولار، Fable 5/Mythos 5 بدولار واحد لكل مليون توكن إدخال مخزَّن.
تصحيح حالة: Claude Opus 4.6 نشط رسمياً (كانت المدخلة تصفه بالقديم)، مع الوضع السريع بسعر 30/150 دولاراً. وسُجِّلت حدود التقاعد المبدئية الرسمية بصيغة "ليس قبل" لكل نماذج Claude النشطة (مثلاً Opus 4.8 ← 28 مايو 2027؛ Sonnet 4.6 ← 17 فبراير 2027).
تَوسَّع سجل الإيقافات بـ 9 مدخلات من إعادة قراءة كاملة لوثائق المزوّدين: موجة OpenAI في 23 يوليو (خمسة معرّفات Codex، وo4-mini-deep-research، وcomputer-use-preview)، وانضمام GPT-4.1 nano وGPT Image 1 إلى قائمة 23 أكتوبر (أحد عشر معرّفاً الآن)، وإيقافات المنصة في 30 نوفمبر (Prompts API، وEvals، وAgent Builder — مُعلَنة في 3 يونيو)، وGemini 3 Pro Image Preview (25 يونيو). التفاصيل في هب الإيقافات. وGemini 3.5 Pro لا يزال غير مُطلَق — لا شيء رسمي يُضاف.
هب /deprecations الجديد: كل تقاعد مُعلَن عبر Anthropic وOpenAI وGoogle مع تواريخ الإغلاق والبدائل وحسابات أسعار الانتقال — إضافةً إلى خمس صفحات انتقال مخصّصة (Claude Sonnet 4، Claude Opus 4/4.1، GPT-4o، موجة OpenAI في أكتوبر، Gemini 2.5)، وخلاصة RSS للإيقافات، ومجموعة بيانات مفتوحة deprecations.json. كل المدخلات مُتحقَّق منها في 12 يونيو مقابل وثائق الإيقاف الرسمية للمزوّدين.
صفحة /price-history الجديدة: السجل الذي يُضاف إليه فقط لأحداث تسعير API الذكاء الاصطناعي المُتحقَّق منها، منشورة كبيانات مفتوحة (CC BY 4.0) من history.json.
تصحيحات المتتبّع من نفس جولة التحقّق: GPT-4o وGPT-4 Turbo يتقاعدان في 23 أكتوبر 2026 (كان المتتبّع يعرض تواريخ أوائل 2026 سابقاً)؛ وإغلاق API لـ Gemini 3 Pro Preview كان في 9 مارس 2026 (لا 26 مارس)؛ وClaude 3 Opus (5 يناير) وClaude 3.5 Haiku (19 فبراير) صارا الآن متقاعدَين؛ وأُضيف Claude Mythos Preview (30 يونيو) وGemini 2.5 Pro/Flash (16 أكتوبر).
أُضيف Claude Fable 5 (صدر في 9 يونيو 2026) إلى الفهرس: 10/50 دولاراً لكل مليون، سعة سياق مليون توكن، إخراج 128K، معرّف API claude-fable-5. أول نموذج من فئة Mythos في التوفّر العام. المصدر: anthropic.com/news/claude-fable-5-mythos-5.
أُعيد GPT-5.4. كان قد حُذف في 1 يونيو بوصفه "غير مُتحقَّق منه" — وكان ذلك قراراً خاطئاً. أُعيد التحقّق منه في 10 يونيو مقابل صفحة تسعير OpenAI وملاحظات الإصدار: صدر في 5 مارس 2026، 2.50/15 دولاراً لكل مليون، إدخال مخزَّن 0.25 دولار، سعة سياق حتى مليون توكن. وأكّدت الجولة نفسها أن Claude Opus 4.6 (5 فبراير)، وGrok 4.20 (10 مارس، 2/6 دولارات، سعة سياق مليونان)، وQwen 3.5 (16 فبراير) كلها حقيقية؛ وأُضيفت المدخلات إلى model-figures.json.
حُدِّث المتتبّع: Claude Sonnet 4 وClaude Opus 4 يتقاعدان في 15 يونيو 2026؛ وClaude Opus 4.1 يتقاعد في 5 أغسطس 2026 (وفق وثائق Anthropic الرسمية).
أُطلقت حزمة أدوات benchr الكاملة: الفهرس المرتّب، الرسوم البيانية، حاسبة التكلفة، مُوصِّي النماذج، متتبّع الإيقافات، والجدول الزمني للإصدارات. كل الأدوات تقرأ من models.json — لا تكرار للبيانات لكل صفحة.
نماذج جديدة أُضيفت إلى الفهرس: Claude Opus 4.8، وGPT-5، وGPT-5 Mini، وGrok 4.3، وKimi K2.6، وMistral Large 3، وLlama 4 Scout، وLlama 4 Maverick. وحُذفت المدخلات غير المُتحقَّق منها (GPT-5.4، وGPT-5.4 mini، وQwen 3.5). كل النماذج الـ 19 الحالية مُتحقَّق منها مقابل صفحات تسعير المزوّدين الرسمية.
تاريخ النسخ الخام (يُضاف إليه فقط): assets/data/history.json. رصدت خطأً؟ قدِّم تصحيحاً تواصل الخصوصية الشروط.