مراجعة Kimi K2.6

نموذج مفتوح الأوزان بحجم تريليون معلمة يستطيع تشغيل مجموعة من الوكلاء الفرعيين عبر آلاف الخطوات. تنزيله مجاني، وتشغيله المستضاف منخفض التكلفة نسبياً.

بقلم فريق benchr التحريري · ، · سجل التغييرات · أُعيد التحقق من بطاقة النموذج والترخيص والسعر المستضاف في 29 يوليو 2026

benchr rating: 4.3 / 5

مراجعة Kimi K2.6: طبقات أدلة ومسارات للمقارنة.
لوحة تحريرية من benchr مراجعة Kimi K2.6 مسارات متناثرة · عائلة السياق الطويل
بحث النماذجيجمع تصميم مراجعة Kimi K2.6 بين طبقات أدلة ومسارات للمقارنة.
إجمالي المعلمات 1T بنية Mixture-of-Experts
المعلمات النشطة 32B ثمانية خبراء مختارين لكل رمز
سعة السياق 256K 262,144 رمزاً. طويلة، لكنها ليست مليوناً
الإخراج المستضاف / 1M $4 الإدخال $0.95 · cache hit ‏$0.16

ينشر Moonshot أوزان Kimi K2.6 بترخيص Modified MIT، ويقدم النموذج نفسه عبر API. المساران لا يحملان المسؤولية نفسها: في المستضاف يدير Moonshot الاستدلال ويبقى تطبيقك مسؤولاً عن المصادقة والأدوات والبيانات والمراقبة؛ وفي الاستضافة الداخلية يصبح فريقك مسؤولاً أيضاً عن السعة والـruntime والتحديثات والأمن والحوادث.

بطاقة النموذج تعرض تعدد الوسائط وسلوكاً موجهاً للوكلاء وجدولاً واسعاً للمعايير. كل النتائج هنا من Moonshot وليست إعادة اختبار من benchr. فائدتها أن ترشح النموذج للتجربة؛ أما قبول الإنتاج فيحسمه اختبار المستودع أدناه.

أي إصدار نقصد هنا

تغطي المراجعة معرّف API ‏kimi-k2.6 ومستودع الأوزان moonshotai/Kimi-K2.6. لا تذكر بطاقة النموذج الرسمية تاريخ إطلاق، لذلك يُترك الحقل بلا تاريخ بدلاً من تحويل تاريخ منتدى أو تغطية خارجية إلى حقيقة نموذج.

ما فائدة Agent Swarm

تعرض Moonshot وضع Agent Swarm للأعمال القابلة للتقسيم إلى فروع: بحث متوازٍ أو استكشاف مستودع أو إنتاج عدة ملفات. الاختبار الصحيح هو استقلال الفروع وقدرة المنسق على كشف التعارض بينها. أما التصحيح التسلسلي الضيق فقد يضيف فروعاً وفاتورة ومخاطر بلا اختصار للمسار الحرج.

لا تفعّله على كل الطلبات. ضع ميزانية ونقطة توقف وعقد مخرج لكل فرع، واحتفظ بالمطالبات والأدوات والأدلة وقرار الدمج. إذا لم تستطع معرفة الفرع الذي جاء منه استنتاج أو تعديل، فقد خسر المسار قابلية التدقيق.

يبرمج مثل نموذج مدفوع، وفق أرقام Moonshot نفسها

حالة البرمجة هي ما يمنح Kimi K2.6 وصف “بديل مفتوح للطبقة الرائدة”. في بطاقة النموذج الرسمية يسجل 80.2 على SWE-Bench Verified و76.7 على SWE-Bench Multilingual و58.6 على SWE-Bench Pro الأصعب، إلى جانب 89.6 على LiveCodeBench v6 و66.7 على Terminal-Bench 2.0. وتدعمه أرقام الاستدلال والوكلاء: 96.4 على AIME 2026 و90.5 على GPQA-Diamond و73.1 على OSWorld-Verified لاستخدام الكمبيوتر و54.0 على Humanity’s Last Exam مع الأدوات. بالنسبة لنموذج يمكن تنزيله مجاناً، هذه ورقة قوية.

للمقارنة عند الاختيار، هذا أقوى مدخل برمجي في طبقة النماذج مفتوحة الأوزان حالياً، ومن المفيد رؤية موقعه أمام بقية الحقل المجاني للتنزيل. يغطي مسح benchr لطبقة النماذج مفتوحة الأوزان الآن كيف يقف Kimi أمام الخيارات المفتوحة الأخرى، ومراجعة DeepSeek-V4 هي المقارنة الطبيعية إذا كنت تختار بين نماذج برمجة مفتوحة الأوزان. وإذا أردت أن ترى كيف يبدو أمام النموذج مفتوح الأوزان ذي الميزانية التسويقية الأكبر، فـ مراجعة Llama 4 هي المقارنة الواضحة الأخرى.

سعة السياق: طويلة، لا هائلة

يحمل Kimi K2.6 سعة سياق 256K رمز، مذكورة كـ “256K” في بطاقة النموذج ومثبتة بدقة عند 262,144 رمزاً (256 × 1,024) في صفحة أسعار API. الرقمان متطابقان، وهذا أكثر مما يمكن قوله عن كثير من ادعاءات السياق. 256K تكفي لاحتواء قاعدة كود معتبرة أو أثر وكيل طويل أو مجموعة مستندات في مطالبة واحدة بلا حيل استرجاع، وتتلاءم مع زاوية الوكلاء لأن التشغيل الذاتي الطويل ينتج كثيراً من السياق الوسيط الذي يحتاج البقاء.

ما ليست عليه: ليست سعة مليون رمز، وهذا الفرق مهم عند تقدير حجم المهمة. لا تخطط لإطعامها مستودعاً كاملاً أو corpus بطول كتاب في دفعة واحدة؛ 256K هو السقف الصلب. للتفكير في حجم السعة مقابل ما ستستخدمه فعلاً، تضع مقارنة benchr لسعات السياق بين النماذج المقياس، ومقالة كيف تُسوّق أرقام سياق المليون رمز هي التصحيح المفيد إذا أغراك رقم كبير في ورقة مواصفات. سعة Kimi البالغة 256K صادقة ومفيدة بالضبط لأنها غير منفوخة.

كم يكلف وكيف تشغّله

هناك ثلاث طرق لاستخدام Kimi K2.6، ولكل منها اقتصاد مختلف جداً. الأولى مجانية: تنزيل الأوزان المفتوحة بترخيص Modified MIT والاستضافة الذاتية. الثانية هي Kimi API المستضاف في platform.kimi.ai، حيث يُفوّتَر kimi-k2.6 عند $0.16 لكل مليون رمز إدخال عند إصابة التخزين المؤقت، و$0.95 لكل مليون إدخال عند عدم الإصابة، و$4.00 لكل مليون إخراج. الثالثة هي أوضاع الدردشة والوكلاء في kimi.com، إضافة إلى “Kimi Code” في kimi.com/code كوكيل برمجة CLI؛ تطبيق الويب لديه طبقة وصول مجانية، لكن Moonshot لا تنشر حدودها الدقيقة.

بالنسبة إلى فرق كثيرة، API المستضاف هو الخيار الأبسط. سعر الإخراج البالغ $4.00 لكل مليون رمز منخفض مقارنة ببعض نماذج البرمجة الرائدة المغلقة، ويتولى المزوّد تشغيل خوادم النموذج. لكنه يبقى بحاجة إلى عمل إنتاجي في المصادقة والمخططات والبث وإعادة المحاولة والحصص ومعالجة البيانات والمراقبة وسلوك الرجوع.

وتضيف الاستضافة الذاتية لنموذج MoE بحجم تريليون معلمة منظومة تقديم متعددة الـGPU، ولا تؤتي أكلها عادةً إلا عند حجم مرتفع ثابت أو حين يلزم نشر معتمد يبقي البيانات داخل بيئتك. ويساعد تفصيل السعر حسب حالة الاستخدام على قياس القرار لأن تشغيل الوكلاء الطويل قد يستهلك رموزاً كثيرة.

المستضاف أم الأوزان داخل بيئتك؟

مصفوفة حدود التشغيل لـKimi K2.6
محور القرارAPI المستضافالاستضافة الذاتيةالدليل المطلوب
الوصول إلى أول نتيجةأسرع عبر endpoint موثقأبطأ بسبب تأهيل العتاد والـruntimeالمهام نفسها ومعيار القبول نفسه
حدود البياناتتحكمها شروط المزوّد وتكامل تطبيقكيمكن إبقاؤها داخل بيئة معتمدةخريطة بيانات وسجلات ونسخ احتياطية وصلاحيات مشغلين
التشغيلMoonshot يدير الاستدلال وأنت تدير التطبيقفريقك يدير الاستدلال والتطبيقسعة وتراجع ومراقبة وضبط إساءة ومالك للحوادث
الاقتصاد$0.95 إدخال غير مخزّن و$0.16 cache hit و$4 إخراج لكل مليونلا فاتورة رمز للمزوّد، لكن العتاد والهندسة باقيانتكلفة النتيجة المقبولة عند استخدام واقعي
التحكم في التغييرتثبيت model ID ومراقبة تغيرات المزوّدتثبيت الأوزان والـruntime والدقة والإعدادبناء قابل للتكرار وبوابة انحدار قبل الترقية

يسمح ترخيص Modified MIT بالاستخدام والتعديل والتوزيع وإعادة الترخيص، لكن تنزيل الأوزان لا يلغي كلفة التشغيل. بطاقة النموذج تسجل 1T معلمة إجمالية و32B نشطة و384 خبيراً مع اختيار ثمانية لكل رمز. يجب أن تسمي خطة الاستضافة الـruntime والدقة وتثبت أن الإعداد يحافظ على الجودة المطلوبة مع سعة احتياطية، لا مجرد عرض تجريبي.

بوابة مستودع قبل الاعتماد

  1. إصلاح محدود: اختر خللاً يمتد عبر عدة ملفات، واطلب التشخيص والتعديل وتشغيل الاختبارات والشرح. سجل التعديل المقبول والانحدارات وتصحيحات المراجع.
  2. تصفح سياق طويل: قدم جزءاً كبيراً من المستودع من دون ملء سقف 262,144 رمزاً، وتحقق من صحة الملفات والرموز المشار إليها ومن أثر السياق غير المهم.
  3. فشل أداة: أدخل أمراً يفشل أو اعتماداً غير متاح. يجب أن يكشف النموذج الفشل ويتوقف عن ادعاء نجاح الاختبارات.
  4. فرع متوازٍ: شغّل Agent Swarm فقط على مهمة تتجزأ فعلاً، وقارن كلفة النتيجة وتعارض الدمج وتكرار العمل واكتمال الأثر بمسار وكيل واحد.
  5. إعادة نشر: كرر المهام الفائزة على إعداد الإنتاج نفسه؛ نتيجة runtime أو quantization مختلفين ليست دليلاً على النشر.

اختره أو أجّل القرار

اختر Kimi K2.6 عندما…أجّله عندما…
تريد مرشح برمجة مفتوح الأوزان وتملك اختبار مستودع حقيقياً.تحتاج معياراً مستقلاً معاد الإنتاج كأساس الموافقة.
قد تبرر إقامة البيانات الاستضافة الداخلية ويوجد مالك للبنية.يُستخدم وصف «مفتوح» بديلاً عن خطة تشغيل.
تستفيد المهمة من استكشاف متوازٍ بفروع قابلة للفحص.المسار تسلسلي ورخيص ومستقر على وكيل أصغر.
تستطيع تثبيت النسخ وحفظ أثر النموذج والأدوات.لا تستطيع إعادة بناء الإعداد أو التراجع عن ترقية فاشلة.

الحكم النهائي

يستحق Kimi K2.6 تجربة جادة لأن بطاقة Moonshot تجمع أوزاناً مفتوحة ونتائج برمجة قوية من المزوّد وسياق 262,144 رمزاً ومساراً مستضافاً موثقاً. لا يحسم أي من ذلك مكان التشغيل.

ابدأ بالمستضاف لتتعلم هل يحل النموذج العمل. لا تنتقل إلى الداخل إلا بعد استقرار بوابة المستودع وتسمية أصحاب البنية والأمن والحوادث. واجعل Agent Swarm طريقاً محدوداً للمهام المتوازية. النشر الفائز هو الذي يحافظ على جودة النتيجة المقبولة وقابلية التدقيق، لا الذي ينقل الفاتورة من API إلى العتاد.

الأسئلة الشائعة

هل يستخدم الفريق API المستضاف أم يستضيف Kimi K2.6 ذاتياً؟

ابدأ بـAPI المستضاف حين يكون الهدف إثبات الجودة والتكامل من دون تشغيل بنية النموذج. لا تنتقل إلى الاستضافة الذاتية إلا إذا بررت إقامة البيانات أو التحكم أو اقتصاد الحجم تشغيل نموذج MoE بحجم 1T معلمة و32B نشطة.

ما الدليل الرسمي على قدرات Kimi K2.6 البرمجية؟

تذكر بطاقة Moonshot ‏80.2 على SWE-Bench Verified و76.7 على SWE-Bench Multilingual و58.6 على SWE-Bench Pro و89.6 على LiveCodeBench v6 و66.7 على Terminal-Bench 2.0. هذه نتائج منشورة من المزوّد ويجب أن تتبعها تجربة على مستودعك.

ماذا يتضمن اختبار عبء العمل لـKimi K2.6؟

استخدم مهام مستودع ممثلة مع اختبارات ثابتة وأثر أدوات ومراجعة للتعديل المقبول وحساب الرموز. قارن API وأي إعداد ذاتي بالمطالبات والصلاحيات وقواعد التوقف وحالات الفشل نفسها.

سجل التغييرات

  • 29 يوليو 2026 — أُعيد بناء المراجعة حول حدود التشغيل بين API والاستضافة الذاتية؛ وحُذف تاريخ الإطلاق المستنتج وتحديث نموذج آخر؛ وأضيفت مصفوفة تشغيل وبوابة مستودع وإرشاد اختيار/تجنب وFAQ محدود بالمصادر.
  • 24 يوليو 2026 — حُذفت صياغة انعدام عبء التشغيل. وأصبح الخيار المستضاف موصوفاً كتقديم نموذج يديره المزوّد مع بقاء مسؤولية التكامل ومعالجة البيانات والمراقبة على التطبيق.
  • 30 مايو 2026 — نُشر أول مرة مع نسبة الترخيص والسعر والسياق ونتائج البرمجة إلى Moonshot بوصفها أرقام مزوّد.

المراجع

  1. Moonshot AI، بطاقة نموذج Kimi K2.6، أُعيد التحقق من البنية والسياق والمعايير في 29 يوليو 2026.
  2. Moonshot AI، السعر المستضاف وقدرات Kimi K2.6، أُعيد التحقق في 29 يوليو 2026.
  3. Moonshot AI، ترخيص Modified MIT لـKimi K2.6، أُعيد التحقق في 29 يوليو 2026.