تصنيف · سعة السياق · سبتمبر 2026

تصنيف سعة السياق لنماذج الذكاء الاصطناعي

النماذج مرتّبة حسب أقصى سعة سياق مدعومة. تصل عدة واجهات رائدة إلى مليون توكن، لكن الحد يختلف حسب النموذج: Claude Haiku 4.5 عند 200K وKimi K2.6 عند 262,144.

البيانات من models.json · مبني على البيانات ومحايد
المرتبة النموذج المزوّد أقصى توكنز السياق أقصى توكنز الإخراج الإدخال $/1M
#1Llama 4 ScoutMeta10,000,000مجاني
#2GPT-5.5OpenAI1,050,000128,000$5.00
#3Gemini 3.5 FlashGoogle1,048,57665,536$1.50
#4Claude Opus 4.8Anthropic1,000,000128,000$5.00
#5Claude Opus 4.7Anthropic1,000,000128,000$5.00
#6Claude Sonnet 4.6Anthropic1,000,00064,000$3.00
#7Gemini 3.1 ProGoogle1,000,00064,000$2.00
#8Grok 4.3xAI1,000,000$1.25
#9DeepSeek V4-ProDeepSeek1,000,000384,000$1.32
#10DeepSeek V4-FlashDeepSeek1,000,000384,000$0.140
#11Llama 4 MaverickMeta1,000,000مجاني
#12GPT-5OpenAI400,000128,000$1.25
#13GPT-5 MiniOpenAI400,000128,000$0.250
#14Kimi K2.6Moonshot AI262,144$0.950
#15Qwen3.6-27BAlibaba262,144مجاني
#16Mistral Large 3Mistral256,000$0.500
#17Mistral Medium 3.5Mistral256,000$1.50
#18Claude Haiku 4.5Anthropic200,00064,000$1.00
#19Phi-4Microsoft16,000مجاني

فئة المليون توكن شائعة وليست عامة

تصل معظم واجهات النماذج المتقدمة الحالية إلى مليون توكن على الأقل: Claude Opus 5 وClaude Sonnet 5 وClaude Fable 5.1 عند 1M، وGPT-6 Astra وGPT-5.6 عند 1.05M، وGemini 3.1 Pro وGemini 3.8 Flash عند نحو 1M. لكن ذلك لا ينطبق على كل نموذج؛ إذ تُسجّل القائمة Claude Haiku 4.5 عند 200,000 توكن، وKimi K2.6 عند 262,144، ونموذج xAI الرائد Grok 4.6 عند 500K، أي نصف سعة Grok 4.3 الأقدم والأرخص البالغة 1M. اعتمد حد النموذج ونقطة النهاية المحددين، لا تعميم العائلة.

يحتفظ GPT-5 وGPT-5 Mini بسعة 400K، لكنهما لم يعودا الفئة الرائدة لدى OpenAI: كل نموذج من OpenAI يسجّله benchr من GPT-5.4 فصاعدًا، ومنها GPT-6 Astra، يُدرج بسعة 1.05M. صار حد 400K يهمّ أساسًا الفرق التي ما زالت مثبّتة على GPT-5؛ فالاسم العائم gpt-5 ما زال يعمل، بينما تتوقف النسخة المؤرخة gpt-5-2025-08-07 في 11 ديسمبر 2026. وإذا كانت السعة سبب الانتقال، فإن GPT-5.6 Luna ‏($0.20 للإدخال و$1.20 للإخراج لكل مليون توكن، وسعة 1.05M) أرخص من GPT-5 Mini ‏($0.25 / $2) في الجانبين.

الاستثناء عند 10M: Llama 4 Scout

تسجل Meta لـLlama 4 Scout سقف سياق يبلغ 10 ملايين توكن. وهو نموذج مفتوح الأوزان تحت Llama Community License، وليس مفتوح المصدر وفق OSI. وتستخدم بنيته MoE ‏109 مليارات معلمة إجمالية و17 ملياراً نشطة لكل توكن. لا يضمن السقف المنشور جودة الاسترجاع ولا اتساع الطول الكامل في أي نشر؛ تحقّق من حد المزوّد والذاكرة وبيئة الخدمة.

لا يضمن الحد المعلن أن تبقى جودة الاسترجاع عند 10 ملايين توكن مماثلة لجودتها عند 200 ألف. قد تفقد النماذج معلومات تقع في منتصف السياق الطويل، لذلك اختبر الاسترجاع من مواضع متعددة قبل الاعتماد على السعة الكاملة في الإنتاج.

حجم السياق مقابل التكلفة

السياق الأكبر يرفع الكلفة لأنك تدفع لكل توكن. طلب يضم 200 ألف توكن يكلّف خمسة أضعاف طلب يضم 40 ألفًا عند السعر نفسه. وقد يكون تقسيم المواد أو استرجاع المقاطع المطلوبة أقل كلفة من إرسال مليون توكن إلى نموذج مرتفع السعر. استخدم السعة الكبيرة عندما تثبت أنها تحسن النتيجة.

فحوص تشغيلية قبل شراء سياق أكبر

أقصى سياق هو رقم سعة، لا ضمان بأن النموذج سيستخدم كل توكن جيداً. اختبر الاسترجاع من بداية المطالبة ومنتصفها ونهايتها؛ فحالات فشل السياق الطويل تظهر غالباً في منتصف المستندات الكبيرة حيث يقبل النموذج النص لكنه لا يستخدمه بموثوقية.

قِس أيضاً زمن الاستجابة وتكلفة بناء المطالبة. استدعاء بمليون توكن قد يبسّط بنيتك، لكنه قد يكون أبطأ وأغلى من الاسترجاع مع سياق أصغر حين يكون الدليل المطلوب صفحات قليلة فقط. الخيار الصحيح هو الذي يعيد الإجابة الصحيحة بأقل سياق إجمالي، لا بأكبر سعة معلنة.

ماذا تسجّل أثناء اختبارات السياق الطويل

عند تقييم سعة سياق كبيرة، لا تكتفِ بتسجيل النجاح أو الفشل. دوّن حجم المطالبة، وموضع الدليل المطلوب، وزمن الاستجابة، وطول المخرَج، وهل استشهد النموذج بالجزء الصحيح من المصدر. نموذج ينجح فقط حين تظهر الإجابة قرب نهاية المطالبة ليس موثوقاً بما يكفي لأتمتة المستندات الكاملة.

في قواعد الشيفرة والمستندات القانونية، قد يفيد نهج هجين: يختار نظام الاسترجاع الملفات أو البنود المطلوبة، ثم يحللها النموذج ضمن سياق أصغر. استخدم السعة الكاملة عندما تحتاج إلى ربط أقسام متباعدة، لا لمجرد أن الواجهة تقبل توكنات أكثر.

للشراء، اسأل المزوّدين هل حجم السياق المعلن متاح على نقطة النهاية والمنطقة والخطة التي تنوي استخدامها بالضبط. بعض المنصات تكشف سعات أصغر عبر سُحُب الشركاء أو الأسماء البديلة القديمة، وهذا الفرق قد يكسر تصميماً مبنياً على مطالبات المستند الكامل.

سجل التغييرات

  • 11 سبتمبر 2026 — أعدنا كتابة فقرتي فئة المليون توكن وGPT-5 وسؤال أكبر سعة سياق حول النماذج الحالية (Claude Opus 5 وSonnet 5 وFable 5.1، وGPT-6 Astra وGPT-5.6، وGrok 4.6 عند 500K)، وسجّلنا أن GPT-5 وGPT-5 Mini لم يعودا الفئة الرائدة لدى OpenAI.
  • — حُذف تعميم المليون توكن على العائلات، وسُجل Claude Haiku 4.5 عند 200K وKimi K2.6 عند 262,144 صراحةً، وصُحح وصف Llama 4 إلى «مفتوح الأوزان، وليس مفتوح المصدر وفق OSI».

أسئلة شائعة

أي نموذج ذكاء اصطناعي يملك أكبر سعة سياق؟

تسجل Meta لـLlama 4 Scout سقفاً قدره 10 ملايين توكن. وهو نموذج مفتوح الأوزان تحت Llama Community License، وليس مفتوح المصدر وفق OSI؛ كما أن الاستضافة الذاتية لها كلفة عتاد وتشغيل. ومن بين APIs التجارية المستضافة، يقدّم Claude Opus 5 وClaude Sonnet 5 وClaude Fable 5.1 سعة مليون توكن، ويقدّم GPT-6 Astra وGPT-5.6 نحو 1.05 مليون.

هل سعة السياق الأكبر تعني دائماً أداءً أفضل؟

لا. سعة السياق هي الحد الأقصى الذي يقبله النموذج، وليست ضمانًا لاستخدام كل جزء من النص بالدقة نفسها. قد تظهر مشكلة «الضياع في المنتصف» عند وضع الدليل بعيدًا عن البداية والنهاية. لذلك قد يتفوق نموذج بسعة أصغر إذا استرجع الدليل المطلوب بموثوقية أعلى في اختبارك.

لماذا يهمّ حجم سعة السياق؟

يحدد حجم سعة السياق كم من المعلومات يمكن للنموذج أن يأخذها في الحسبان في تمريرة واحدة. لتحليل الأكواد، تعني السعة الأكبر احتواء جزء أكبر من قاعدة الأكواد دفعة واحدة. ولمراجعة المستندات، تعني أجزاءً أقل وعبئاً أقل من التلخيص. وللوكلاء، تعني سجلات محادثة أطول دون اقتطاع. الحد العملي عادةً هو التكلفة — فالسياقات الأطول تكلف أكثر لكل استدعاء.