تشحن المختبرات الكبرى شيئاً ذا بال كل بضعة أسابيع. تُدرج هذه الصفحة الإصدارات المهمة منذ مطلع 2026، بترتيب زمني عكسي. للتغطية الأعمق لكل نموذج، راجع المقال المرتبط أو أداة المقارنة.
كل إصدارات 2026 بالتاريخ
صفّ واحد لكل نموذج، الأحدث أولاً. التاريخ هو يوم إطلاق المزوّد له، والسعر هو سعر القائمة لكل مليون توكن، والشرطة تعني رقماً لم ينشره المزوّد — لا رقماً منقولاً من نموذج قريب.
انتقل إلى شهر: سبتمبر 2026 · أغسطس 2026 · يوليو 2026 · يونيو 2026 · مايو 2026 · أبريل 2026 · مارس 2026 · فبراير 2026
| الإصدار | النموذج | المزوّد | السياق | $ / مليون: إدخال ← إخراج |
|---|---|---|---|---|
| GPT-6 Astra | OpenAI | 1.05M | $10.00 → $50.00 | |
| Gemini 3.8 Flash | 1M | $0.75 → $3.75 | ||
| Claude Mythos 5.1 | Anthropic | 1M | $10.00 → $50.00 | |
| Claude Fable 5.1 | Anthropic | 1M | $10.00 → $50.00 | |
| Qwen3.8-Flash | Alibaba (Qwen) | 256K | $0.15 → $0.47 | |
| GLM-5.3-Flash | Z.ai | 1M | $0.07 → $0.25 | |
| DeepSeek-V4-Flash-Vision-Exp | DeepSeek | 1M | $0.44 → $1.32 | |
| GLM-5.3 | Z.ai | 1M | $1.4 → $4.4 | |
| Gemini 3.7 Flash | 1M | $0.75 → $3.75 | ||
| Grok 4.6 | xAI | 500K | $2.00 → $6.00 | |
| Qwen3.8-Max | Alibaba (Qwen) | 1M | $2.00 → $6.00 | |
| Claude Opus 5 | Anthropic | 1M | $5.00 → $25.00 | |
| Gemini 3.6 Flash | 1M | $0.75 → $3.75 | ||
| Gemini 3.5 Flash-Lite | 1M | $0.3 → $2.5 | ||
| Kimi K3 | Moonshot AI | 1M | $3.00 → $15.00 | |
| Qwen-Audio 3.0 TTS Plus | Alibaba (Qwen) | — | — | |
| Qwen-Audio 3.0 TTS Flash | Alibaba (Qwen) | — | — | |
| Muse Spark 1.1 | Meta | 1M | — | |
| GPT-5.6 Terra | OpenAI | 1.05M | $2.00 → $12.00 | |
| GPT-5.6 Sol | OpenAI | 1.05M | $4.00 → $20.00 | |
| GPT-5.6 Luna | OpenAI | 1.05M | $0.2 → $1.2 | |
| Grok 4.5 | xAI | 500K | $2.00 → $6.00 | |
| GPT-Live-1 mini | OpenAI | — | — | |
| GPT-Live-1 | OpenAI | — | — | |
| Muse Image | Meta | — | — | |
| GPT-Realtime-2.1 mini | OpenAI | 125K | — | |
| GPT-Realtime-2.1 | OpenAI | 125K | — | |
| Leanstral 1.5 | Mistral AI | — | — | |
| Claude Sonnet 5 | Anthropic | 1M | $2.00 → $10.00 | |
| Gemini Omni Flash Preview | 1M | $1.5 → — | ||
| Gemini 3.1 Flash Lite Image (Nano Banana 2 Lite) | 64K | $0.25 → — | ||
| Qwen-AgentWorld-35B-A3B | Alibaba (Qwen) | 256K | — | |
| Mistral OCR 4 | Mistral AI | — | — | |
| GLM-5.2 | Z.AI | 1M | $1.4 → $4.4 | |
| Claude Mythos 5 | Anthropic | 1M | $10.00 → $50.00 | |
| Claude Fable 5 | Anthropic | 1M | $10.00 → $50.00 | |
| Qwen3.7-Plus | Alibaba (Qwen) | 1M | $0.4 → $1.6 | |
| MiniMax M3 | MiniMax | 1M | $0.3 → $1.2 | |
| Grok Build 0.1 | xAI | 250K | $1.00 → $2.00 | |
| Claude Opus 4.8 | Anthropic | 1M | $5.00 → $25.00 | |
| Gemini 3.5 Flash | 1M | $1.5 → $9.00 | ||
| Mistral Medium 3.5 | Mistral AI | 250K | $1.5 → $7.5 | |
| DeepSeek-V4-Pro | DeepSeek | 1M | $1.32 → $3.96 | |
| DeepSeek-V4-Flash | DeepSeek | 1M | $0.44 → $1.32 | |
| GPT-5.5 | OpenAI | 1.05M | $5.00 → $30.00 | |
| Qwen3.6-27B (dense) | Alibaba (Qwen) | 256K | — | |
| ChatGPT Images 2.0 (GPT Image 2) | OpenAI | — | — | |
| Qwen3.6-35B-A3B (MoE) | Alibaba (Qwen) | 256K | — | |
| Claude Opus 4.7 | Anthropic | 1M | $5.00 → $25.00 | |
| Gemini 3.1 Flash TTS Preview | 8K | — | ||
| Qwen3.6-Plus | Alibaba (Qwen) | 1M | $0.5 → $3.00 | |
| Gemma 4 31B IT | 250K | — | ||
| Gemma 4 26B A4B IT | 250K | — | ||
| Mistral Small 4 | Mistral AI | 250K | $0.15 → $0.6 | |
| Grok 4.20 | xAI | 1M | $1.25 → $2.5 | |
| GPT-5.4 | OpenAI | 1.05M | $2.5 → $15.00 | |
| Gemini 3.1 Pro | 1M | $2.00 → $12.00 | ||
| Claude Sonnet 4.6 | Anthropic | 1M | $3.00 → $15.00 | |
| Qwen3.5-397B-A17B | Alibaba (Qwen team) | 256K | — | |
| Claude Opus 4.6 | Anthropic | 1M | $5.00 → $25.00 |
سبتمبر 2026
- GPT-6 Astra — 3 سبتمبر 2026. أطلقت OpenAI النموذج
gpt-6-astraوتصفه بأنه أقدر نماذجها، موجَّهاً إلى الاستدلال والبرمجة واستخدام الحاسوب والبحث وإنشاء المستندات. ويُدرج دليل النماذج نافذة سياق 1.05M وحدّ معرفة حتى 30 أبريل 2026، ولا ينشر حدّاً أقصى للإخراج، فلا يسجّل benchr واحداً. والسعر $10.00 إدخالاً و$1.00 إدخالاً مخزَّناً و$50.00 إخراجاً لكل مليون توكن، والدفعات نصف كلٍّ منها — أي 2.5 ضعف GPT-5.6 Sol في السعرين الرئيسيين. ويسجّل سجل التغييرات قيوداً في الواجهة هي عوائق ترحيل لا هوامش: لا مستوىnoneلجهد الاستدلال، ولا حرارة مخصّصة ولاtop_pولاlogprobs، واستدعاء الأدوات عبر Responses API فقط. ولم تنشر OpenAI جدول اختبارات مع الإصدار. مصدر السعر: OpenAI. - Gemini 3.8 Flash — 2 سبتمبر 2026. أتاحت Google النموذج
gemini-3.8-flashللجميع بنافذة سياق 1M وحد إخراج أقصى 64K. السعر التمهيدي $0.75 للإدخال و$3.75 للإخراج لكل مليون رمز حتى 31 ديسمبر 2026، والإدخال المخزَّن $0.075؛ وتتضاعف كل الشرائح في 1 يناير 2027، بما فيها الدفعات والمرن والأولوية والإدخال المخزَّن. وهناك طبقة مجانية للواجهة. ونسخة Cyber متغيّر متخصص من النموذج نفسه، متاح فقط عبر برنامج Fairwind، وليس نموذجاً مسعَّراً منفصلاً في التوثيق، فلا سجل له في benchr. وتقول Google إن 3.7 Flash ما زال مدعوماً بالكامل. مصدر السعر: Google · مراجعة benchr. - Claude Fable 5.1 وClaude Mythos 5.1 — 1 سبتمبر 2026. أطلقت Anthropic المعرّفين
claude-fable-5-1وclaude-mythos-5-1المقيد الوصول. يسجل كلاهما سياق 1M وإخراجاً أقصى 128K واستدلالاً تكيفياً وسعراً قياسياً 10/50 دولاراً للإدخال/الإخراج لكل مليون و0.25 دولار لقراءة الكاش و5/25 دولاراً للدفعات. Fable 5.1 متاح عموماً عبر Anthropic ومسارات الشركاء المدعومة؛ أما Mythos 5.1 فمحصور في وصول Project Glasswing المُدقَّق. تغيّر عقد الترحيل: اختيار أداة مسمّى أو إجباري، وضبط التفكير اليدوي، وملء المساعد مسبقاً تعيد أخطاءً. المصدر: Anthropic · الأسعار.
أغسطس 2026
- Qwen3.8-Flash — 27 أغسطس 2026. أصدرت Alibaba نموذجاً متعدد الوسائط بمعمارية خبراء مختلطة: نموذج أساس 125B ومعه 51B إضافية من تضمينات N-gram، ينشّط 6B معاملاً لكل توكن، بنافذة أصلية 262K يقول الإعلان إنها تمتدّ إلى مليون. ويُدرجه Model Studio بسعر $0.15 إدخالاً و$0.47 إخراجاً لكل مليون توكن في منطقة سنغافورة. وتسمّي Alibaba اختبارات SWE-bench Pro وCoWorkBench وToolathlon Verified وMathVision وAndroidWorld وERQA في الإصدار دون نشر نتائج لها، ولا تسمّي رخصة، فلا يسجّل benchr أياً منهما. مصدر السعر: Alibaba Cloud.
- GLM-5.3-Flash — 26 أغسطس 2026. أصدرت Z.ai نموذجاً متعدد الوسائط أصلاً بمعمارية خبراء مختلطة، 320B إجمالاً و18B نشطة، بنافذة سياق مليون رمز وحد إخراج 128K، وأوزان منشورة برخصة MIT. ويخفض عرض الإطلاق كل الأسعار إلى النصف حتى 9 سبتمبر 2026: $0.075 إدخالاً و$0.25 إخراجاً و$0.015 للإدخال المخزَّن لكل مليون رمز، مقابل سعر القائمة $0.15 / $0.50 / $0.03. وأرقام Terminal-Bench 2.1 وDeepSWE وHumanity’s Last Exam المنشورة هي أرقام Z.ai نفسها، مقيسة عند سياق 300K لا عند نافذة الواجهة الكاملة، وليست اختبارات benchr. مصدر السعر: Z.ai.
- DeepSeek-V4-Flash-Vision-Exp — 21 أغسطس 2026. نشرت DeepSeek نقطة تحقّق تجريبية للرؤية تُستدعى بالمعرّف
deepseek-v4-flash-vision-exp، بنافذة سياق مليون رمز وحد إخراج 384K و2,500 طلب متزامن. ويضعها جدول الأسعار مع DeepSeek-V4-Flash بالسعر نفسه: $0.44 إدخالاً و$1.32 إخراجاً لكل مليون رمز، ينخفض إلى النصف خارج ساعات الذروة، وإصابة المخزون $0.014؛ وتُحسب الصور رموزاً حسب أبعادها وتُحاسب كإدخال. وتصف DeepSeek النقطة بأنها تجريبية، أي قد تتغيّر أو تختفي دون إشعار إيقاف، ولم يُعثر لها على رخصة أو أوزان مفتوحة في صفحة رسمية. وأرقام الاختبارات المنشورة هي أرقام DeepSeek نفسها لهذه النقطة، وليست اختبارات benchr. مصدر السعر: DeepSeek. - خفض سعر GPT-5.6 Sol — 21 أغسطس 2026. أنزلت OpenAI سعر Sol من 5$/30$ إلى 4$ للإدخال و20$ للإخراج لكل مليون توكن، أي خفض 20% في الإدخال و33% في الإخراج، ونزل الإدخال المخزّن إلى 0.40$. وتصف صفحة التغييرات السعر بأنه ترويجي ومتاح حتى 21 نوفمبر 2026 على الأقل. المصدر: OpenAI. تسعير benchr.
- تحديث Model Spec لدى OpenAI — حدّثت OpenAI مواصفة سلوك النماذج في 18 أغسطس. هذا تغيير سياسة سلوك وليس نموذج إنتاج جديداً، لذلك تسجله BenchR بلا اختراع SKU أو معرّف API. المصدر الرسمي.
- GLM-5.3 — أطلقت Z.AI المسار المستضاف
glm-5.3في 18 أغسطس بسياق مليون وإخراج 128K واستدلال دائم وسعر 1.40/4.40 دولار. أعلنت الأوزان بعد تقوية الأمان ولم نسجلها متاحة بعد. تحليل BenchR · المصدر الرسمي. - Grok 4.6 في GitHub Copilot — أعلنت xAI إتاحة Grok 4.6 في GitHub Copilot في 14 أغسطس، بعد يومين من إطلاق API. المصدر الرسمي.
- Gemini 3.7 Flash — متاح عمومًا في 13 أغسطس 2026. تصف Google المعرّف
gemini-3.7-flashبأنه أذكى نموذج عملي لديها للبرمجة والوكلاء، بحد إدخال 1,048,576 توكن وحد إخراج 65,536. السعر التمهيدي 0.75$ للإدخال و3.75$ للإخراج لكل مليون توكن حتى 31 ديسمبر 2026، ثم 1.50$/7.50$ — وهو السعر نفسه الذي خُفض إليه Gemini 3.6 Flash. ولم تنشر Google أي جدول بنشمارك. المصدر: Google. تحليل benchr. - Grok 4.6 — أُعلن في 12 أغسطس 2026. تدرج xAI المعرّف
grok-4.6بسعة سياق 500 ألف توكن وسعر 2$ للإدخال و6$ للإخراج و0.50$ للمخزّن مؤقتًا لكل مليون توكن تحت 200 ألف توكن، ويتضاعف فوقها. وتصفه xAI بأنه نموذجها المتقدم للوكلاء طويلة الأمد والعمل التفاعلي والبصري، وتنشر معه جدول أرقام من عندها. المصدر: xAI. - Qwen3.8-Max — 3 أغسطس 2026. أعلنت Alibaba أكبر نماذجها حتى تاريخه: نموذج خبراء مختلطة متناثر بـ2.4T معاملاً إجمالاً ينشّط 95B لكل توكن، متعدد الوسائط نصاً ورؤيةً، بنافذة سياق يصفها الإعلان بأنها تصل إلى مليون توكن. ويُدرجه Model Studio بسعر $2.00 إدخالاً و$6.00 إخراجاً لكل مليون توكن في منطقة سنغافورة. ونشرت Alibaba مراتب في ساحات المقارنة بدل نتائج رقمية — الخامس في Text Arena، والثاني في Vision Arena، والرابع في Frontend Code Arena — والمرتبة ليست نتيجة، فلا يسجّل benchr أرقام اختبارات. وقيل إن الأوزان تتبع في الأسبوع التالي؛ ولم يتحقّق benchr من رخصة في صفحة رسمية. مصدر السعر: Alibaba Cloud.
يوليو 2026
- Kimi K3 — أطلقت Moonshot AI Kimi K3 في 16 يوليو ثم نشرت الأوزان. يسجل المصدر 2.8T إجمالاً و104B نشطة وسياق 1,048,576 وسعر API قدره 3 دولارات لـcache miss و0.30 لـcache hit و15 للإخراج لكل مليون. تحليل BenchR · المصدر الرسمي.
- Claude Opus 5 — أطلقت Anthropic Claude Opus 5 في 24 يوليو 2026؛ وتفصل الصفحة سجل الـAPI وخطوات الترحيل. تحليل benchr · المصدر الرسمي.
- GPT-Realtime-2.1 — أعلنت OpenAI GPT-Realtime-2.1 في 6 يوليو 2026 لتجارب الصوت متعددة الوسائط. تحليل benchr · المصدر الرسمي.
- GPT-Realtime-2.1 mini — أعلنت OpenAI GPT-Realtime-2.1 mini في 6 يوليو 2026 كخيار الصوت الفوري الأقل تكلفة. تحليل benchr · المصدر الرسمي.
- GPT-Live-1 — قدمت OpenAI GPT-Live-1 في 8 يوليو 2026 لصوت ChatGPT وقالت إن API مخططة. تحليل benchr · المصدر الرسمي.
- GPT-Live-1 mini — قدمت OpenAI GPT-Live-1 mini في 8 يوليو 2026 ضمن طرح ChatGPT Voice. تحليل benchr · المصدر الرسمي.
- Gemini 3.5 Flash-Lite — أطلقت Google Gemini 3.5 Flash-Lite بإتاحة عامة في 21 يوليو 2026. تحليل benchr · المصدر الرسمي.
- Leanstral 1.5 — أصدرت Mistral Leanstral 1.5 في 2 يوليو 2026 كمتخصص تحقق رسمي برخصة Apache-2.0. تحليل benchr · المصدر الرسمي.
- Qwen-Audio 3.0 TTS Plus — أطلقت Alibaba Cloud Qwen-Audio 3.0 TTS Plus في 14 يوليو 2026. تحليل benchr · المصدر الرسمي.
- Qwen-Audio 3.0 TTS Flash — أطلقت Alibaba Cloud Qwen-Audio 3.0 TTS Flash في 14 يوليو 2026. تحليل benchr · المصدر الرسمي.
- Muse Image — أطلقت Meta Muse Image في 7 يوليو 2026 وجعلته متاحاً في Meta AI. تحليل benchr · المصدر الرسمي.
- Muse Video Preview — عاينت Meta Muse Video في 7 يوليو 2026 مع Muse Image. تحليل benchr · المصدر الرسمي.
- Gemini 3.6 Flash — أُصدر في 21 يوليو 2026 كنموذج مستقر في Gemini API. تسعّره Google عند 1.50 دولار للإدخال و7.50 دولارات للإخراج و0.15 دولار لـcache input لكل مليون توكن، مع سعة إدخال 1,048,576 توكن وحد إخراج 65,536 توكن. المصدر: Google. تحليل benchr.
- Meta Muse Spark 1.1 — أُصدر في 9 يوليو 2026 كمعاينة عامة عبر Meta Model API. تصفه Meta كنموذج متعدد الوسائط بسياق مليون توكن لأعمال الإبداع والسياق الطويل؛ لم تنشر Meta سعراً عاماً للـAPI، لذلك يتتبعه benchr في model-figures.json ولا يضعه في أداة الترتيب السعرية حالياً. المصدر: Meta.
- Grok 4.5 — وصل إلى API لدى xAI في 8 يوليو 2026. تسجّل xAI معرّف
grok-4.5بسياق 500 ألف توكن، وسعر 2 دولار للإدخال و6 دولارات للإخراج و0.50 دولار للإدخال المخزّن لكل مليون توكن. لا تنشر xAI بعد جدول معايير رسمي أو حد إخراج أقصى لهذا النموذج. مراجعة benchr · المصدر: xAI · تسعير benchr. - GPT-5.6 — متاح عبر API — 9 يوليو 2026. تؤكد صفحات OpenAI للنماذج والتسعير وسجل التغييرات أن Sol وTerra وLuna خرجت من معاينة 26 يونيو إلى الإتاحة العامة عبر API. الأرقام المؤكَّدة: Sol بـ 5/30 دولاراً لكل مليون توكن، وTerra بـ 2.50/15 دولاراً، وLuna بـ 1/6 دولارات؛ وتدرج OpenAI سياق 1.05 مليون توكن وأقصى إخراج 128 ألف توكن للطبقات الثلاث. المصدر: OpenAI. تغطية benchr · التسعير.
- Claude Sonnet 5 — صدر في 1 يوليو 2026. ثاني نموذج من Anthropic ببنية فئة Mythos بعد Claude Fable 5، بسعر 2/10 دولارات لكل مليون توكن — ثبّتته Anthropic قياسيًا في 31 أغسطس بعد إلغاء زيادة 3/15 دولارًا — مع سياق مليون توكن وأقصى إخراج 128 ألف توكن، أي ضعف 64 ألفاً في Sonnet 4.6. تنسب Anthropic إليه SWE-bench Verified بنسبة 89.4% وGPQA Diamond بنسبة 92.0%. يعيد الطلب المصنّف أمنياً رفضاً صريحاً؛ وتتطلب المحاولة على نموذج آخر إعداداً في التطبيق أو المنتج. المصدر: Anthropic. تغطية benchr · التسعير.
- استعادة Claude Fable 5 لجميع العملاء — 1 يوليو 2026. أُغلقت مراجعة ضوابط التصدير الأمريكية التي علّقت Fable 5 في 12 يونيو، واستعادت Anthropic الوصول لجميع العملاء، مع استعادة AWS الوصول على Bedrock في اليوم نفسه؛ ويبقى Claude Mythos 5 مقصوراً على مشروع Glasswing. جاء ذلك في اليوم نفسه الذي أُطلق فيه Claude Sonnet 5 أعلاه. المصدر: Anthropic. تغطية benchr.
يونيو 2026
- Gemini Omni Flash Preview — أُصدر في 30 يونيو 2026. يقبل النص والصورة والفيديو والصوت مدخلاً، وينتج نصاً ومقاطع فيديو قصيرة. توثق Google سياق 1,048,576 توكن وسعراً قدره 1.50 دولار للإدخال و9 دولارات لإخراج النص و17.50 دولاراً لإخراج الفيديو لكل مليون توكن. المصدر: Google.
- Gemini 3.1 Flash Lite Image — أُصدر في 30 يونيو 2026. تدرجه Google كنموذج صور متاح عموماً من عائلة Nano Banana 2 Lite، بسياق 65,536 توكن وأقصى إخراج 4,096 توكن، وسعر 0.25 دولار للإدخال و1.50 دولار لإخراج النص و30 دولاراً لإخراج الصورة لكل مليون توكن. المصدر: Google.
- GLM-5.2 — أُصدر في 16 يونيو 2026 من Z.AI. معرّف API هو
glm-5.2، بسياق مليون توكن وأقصى إخراج 128 ألف توكن، وسعر 1.40 دولار للإدخال و4.40 دولار للإخراج و0.26 دولار لإصابة الكاش لكل مليون توكن. مراجعة benchr · المصدر: Z.AI · تسعير benchr. - MiniMax M3 — أُصدر في 1 يونيو 2026. تدرج MiniMax معرّف
MiniMax-M3كنموذج نصي بسياق مليون توكن، وسعر قياسي 0.30 دولار للإدخال و1.20 دولار للإخراج و0.06 دولار لإصابة الكاش لكل مليون توكن؛ أما السياق الطويل والأولوية فلهما طبقات أغلى. المصدر: MiniMax. تسعير benchr. - GPT-5.6 — معاينة Sol وTerra وLuna — بدأت في 26 يونيو 2026. هذه حالة تاريخية عند يوم الإعلان وليست الحالة الحالية: كان الوصول وقتها مقصوراً على نحو 20 شريكاً موثوقاً عبر API وCodex، وكانت OpenAI تقول إن الإتاحة العامة ستأتي خلال أسابيع. أعلنت أسعار Sol عند 5/30 دولارات، وTerra عند 2.50/15 دولاراً، وLuna عند 1/6 دولارات لكل مليون توكن، لكن صفحة التسعير ومعرّفات API وسعات السياق لم تكن منشورة بعد في ذلك اليوم. كما نسبت OpenAI إلى Sol نتائج على Terminal-Bench 2.1 وExploitBench وتقييمات الأحياء؛ وهي ادعاءات مزوّد كما عُرضت في إعلان المعاينة. لاحقاً، في 9 يوليو، انتقلت الطبقات الثلاث إلى الإتاحة العامة عبر API ونُشرت مواصفاتها؛ انظر مدخل يوليو أعلاه. مصدر المعاينة: OpenAI.
- Mistral OCR 4 — أُصدر في 23 يونيو 2026. نموذج قياسي للتعرّف الضوئي على المستندات: أُطر إحاطة على مستوى الفقرة، ووسوم للكتل المصنّفة، ودعم 170 لغة. يُسعَّر بالصفحة لا بالرمز (4 دولارات لكل 1000 صفحة في الوضع القياسي، و2 دولار في الدُفعات، و5 دولارات في Document AI). المصدر: Mistral.
- Qwen-AgentWorld 35B-A3B — أُصدر في 24 يونيو 2026. نموذج مفتوح الأوزان (Apache-2.0) لمحاكاة تفاعل الوكلاء مع البيئة عبر سبعة مجالات؛ سياقه 256 ألف توكن، وهو متاح للتنزيل فقط. المصدر: Qwen.
- Kimi K2.7-Code — نموذج من Moonshot مخصص للبرمجة ومبني على K2.6. يسجل المصدر سعراً قدره 0.95 دولار لكل مليون توكن إدخال عند عدم إصابة الذاكرة المؤقتة، و0.19 دولار عند الإصابة، و4 دولارات للإخراج، مع سياق 256 ألف توكن ورخصة Modified MIT. تضاعف فئة Highspeed السعر إلى 1.90/8 دولارات مقابل سرعة تقارب 180 توكناً في الثانية. لا تنشر Moonshot تاريخ إصدار رسمياً. المصدر: Moonshot. تسعير benchr بالإنجليزية.
- Claude Fable 5 وClaude Mythos 5 — أُصدرا في 9 يونيو 2026. يسعّر Fable 5 عند 10/50 دولاراً لكل مليون رمز، بسياق مليون رمز وحد إخراج 128 ألفاً؛ ويعيد الطلب المصنّف أمنياً رفضاً صريحاً، بينما تتطلب المحاولة على نموذج آخر إعداداً مسبقاً. يبقى Mythos 5 مقصوراً على Project Glasswing. المصدر: Anthropic. تغطية benchr. التسلسل: عُلّق النموذجان في 12 يونيو، ورُفعت الضوابط في 30 يونيو، وعاد الوصول في 1 يوليو. يتوفر Fable 5 عالمياً، بينما يبقى Mythos 5 للمنظمات المعتمدة في Glasswing.
مايو 2026
- Grok Build 0.1 — وصل إلى واجهة xAI البرمجية في نسخة بيتا عامة نحو 29 مايو 2026. نموذج برمجة وكيلي، سياق 256 ألف رمز، 1.00 دولار / 2.00 دولار لكل مليون رمز. المصدر: xAI.
- Qwen3.7-Max — أعلنت عنه Alibaba في 21 مايو 2026، وهو متاح الآن عبر Model Studio. نص الإعلان نفسه قال إن الوصول عبر API «قريباً»، لذلك لا ينسب benchr إليه تاريخ إتاحة أولى غير موثّق. سعر القائمة الدولي في سنغافورة 2.50 دولار للإدخال و7.50 دولارات للإخراج لكل مليون رمز، ضمن فئة إدخال تصل إلى مليون رمز. الإعلان؛ الإتاحة الحالية؛ التسعير.
- Claude Opus 4.8 — أُصدر في 28 مايو 2026. أحدث نموذج حدّي من Anthropic. نفس سعر 4.7 بـ 5 دولارات مدخلاً و25 دولاراً مخرجاً، 69.2% على SWE-Bench Pro (مقارنةً بـ 64.3%)، مع مكسب ملحوظ في الأمانة والتوافق. مراجعة benchr.
- Gemini 3.5 Flash — أُصدر في 19 مايو 2026. يتفوق على Gemini 3.1 Pro في معظم معايير البرمجة والأتمتة. 1.50 دولاراً مدخلاً / 9 دولارات مخرجاً لكل مليون رمز. سياق مليون رمز. المصدر: Google. مراجعة benchr.
أبريل 2026
- Gemini 3.1 Flash TTS Preview — أطلقت Google Gemini 3.1 Flash TTS Preview في 15 أبريل 2026. تحليل benchr · المصدر الرسمي.
- Gemma 4 26B A4B IT — أطلقت Google gemma-4-26b-a4b-it في 2 أبريل 2026 ضمن Gemma 4. تحليل benchr · المصدر الرسمي.
- Gemma 4 31B IT — أطلقت Google gemma-4-31b-it في 2 أبريل 2026 ضمن Gemma 4. تحليل benchr · المصدر الرسمي.
- Mistral Medium 3.5 — أُصدر في 29 أبريل 2026. كثيف بـ 128 مليار معامل، سياق 256 ألف رمز، رؤية مدمجة. يحلّ محل Medium 3.1 وMagistral وDevstral 2 في نموذج واحد. 1.50 دولاراً / 7.50 دولارات لكل مليون رمز. رخصة MIT معدَّلة. المصدر: Mistral. مراجعة benchr.
- DeepSeek V4-Pro وV4-Flash — أُصدرا في 24 أبريل 2026. V4-Pro: نموذج MoE بـ 1.6 تريليون معامل و49 مليار معامل نشطة، 80.6% على SWE-bench Verified. V4-Flash: MoE بـ 284 مليار معامل و13 مليار نشطة، 0.14 دولار مدخلاً عند الإطلاق، ثم 0.44 دولار في الذروة و0.22 خارجها منذ 16 أغسطس 2026. المصدر: DeepSeek. مراجعة benchr.
- GPT-5.5 — أُصدر في 23 أبريل 2026. أحدث نموذج حدّي من OpenAI. 5 دولارات مدخلاً / 30 دولاراً مخرجاً. سياق مليون رمز. قوي في Terminal-Bench وFrontierMath. المصدر: OpenAI. مراجعة benchr.
- Claude Opus 4.7 — أُصدر في 16 أبريل 2026. نفس سعر Opus 4.6 بـ 5 دولارات / 25 دولاراً، 87.6% على SWE-bench Verified. مُجزّئ الرموز الجديد يُنتج ما يصل إلى 35% رموزاً إضافية لكل طلب. المصدر: Anthropic. مراجعة benchr.
مارس 2026
- Mistral Small 4 — أُصدر في 16 مارس 2026. نموذج MoE هجين مفتوح الأوزان (Apache-2.0)، بإجمالي 119 مليار معامل و6 مليارات نشطة، سياق 256 ألف رمز، يقبل النص والصورة مدخلاً. 0.15 دولار / 0.60 دولار لكل مليون رمز. المصدر: Mistral.
- عائلة GPT-5.4 — أُصدرت في 5 مارس 2026 (Thinking + Pro). تبعتها GPT-5.4 mini وnano في 17 مارس. 2.50 دولار / 15 دولاراً للنموذج الرئيسي، سياق يصل إلى مليون رمز، واستخدام حاسوب مدمج. أُطلقت مع ChatGPT for Excel. المصدر: OpenAI.
- GPT-5.3 Instant — أُصدر في 3 مارس 2026 نموذجاً افتراضياً لـ ChatGPT. حل محله GPT-5.5 Instant في 5 مايو؛ يحتفظ به المشتركون المدفوعون نحو ثلاثة أشهر من ذلك التاريخ. المصدر: ملاحظات إصدار OpenAI.
- إيقاف Gemini 3 Pro — في 9 مارس 2026. حلّت محله Gemini 3.1 Pro Preview بوصفها الطبقة Pro. المصدر: سجل تغييرات Google.
فبراير 2026
- Gemini 3.1 Pro Preview — أُصدر في 19 فبراير 2026. 2 دولار مدخلاً / 12 دولاراً مخرجاً لكل مليون رمز. لا تزال الطبقة Pro؛ وGemini 3.5 Pro لم يصدر بعد حتى وقت كتابة هذا السطر. مراجعة benchr.
- Qwen 3.5 — أُصدر في 16 فبراير 2026. النموذج الرئيسي MoE بـ 397 مليار معامل و17 مليار نشطة؛ العائلة تمتد عبر تسعة أحجام، معظمها تحت Apache 2.0. حلّت محله سلسلة Qwen3.6 في أبريل. المصدر: Qwen على GitHub. مراجعة benchr.
ما يستحق المتابعة
عودة Claude Fable 5 — أُغلق الملف. انتهت مراجعة ضوابط التصدير التي فتحتها وزارة التجارة في يونيو في 1 يوليو 2026، واستعادت Anthropic الوصول لجميع العملاء إلى Fable 5، مع استعادة AWS الوصول على Bedrock في اليوم نفسه. يبقى Claude Mythos 5 مقصوراً على مشروع Glasswing.
ما التالي. كشفت OpenAI عن نموذج قادم باسم Astra في إعلان لتخطيط الأمان، لكنها لم تطلق بطاقة إنتاج أو معرّف API أو سعراً؛ لذلك يبقى بند متابعة لا سجل نموذج في BenchR. كما تبقى أوزان GLM-5.3 خلف فترة تقوية الأمان المعلنة، ويحل موعد الإيقاف الكامل لـKimi K2.5 وسلسلة Moonshot V1 في 31 أغسطس.
طبقة النماذج مفتوحة الأوزان (DeepSeek V4 وQwen 3.5/3.6 وMistral Medium 3.5) قلّصت الفجوة مع المختبرات المغلقة إلى نقاط قليلة في معظم التقييمات. قادة البرمجة والتفكير موزّعون الآن بين المعسكرين.
سجل التغييرات
- — أُضيف Fable 5.1 وMythos 5.1 من مصادر Anthropic الرسمية، مع دليل ترحيل وتسعير ثنائي اللغة.
- — أُضيف مسح أغسطس من المصادر الرسمية وسجل Kimi K3 لشهر يوليو وتغييرات دورة الحياة وروابط التحليلات الثنائية الأربعة.