Grok 4.6: سياق 500K لوكلاء طويلين بلا رقم معلن لسقف الإخراج

تراهن xAI على وكلاء برمجة أطول، لكن سعر 2/6 الابتدائي يتضاعف عندما يصل البرومبت إلى 200K.

بقلم فريق benchr التحريري · · سجل التغييرات · تحققنا من الحقائق المنشورة في المصادر الرسمية في 21 أغسطس 2026

مسار بناء طويل ومتكرر يعبر بوابات الأدوات والاختبار والتحقق.
لوحة نموذج من benchr Grok 4.6 500K · دورة وكيل طويلة
رسم تحريريرسم تحريري من benchr لوكيل برمجي طويل تحيط به بوابات مراجعة صريحة.
الإدخال الأساسي / 1M$2برومبت أقل من 200K
إخراج الشريحة الطويلة / 1M$12برومبت 200K فأكثر
السياق500Kلا سقف إخراج رقمي منشور
الاستدلال4من low إلى xhigh

أطلقت xAI النموذج في 12 أغسطس 2026، ثم أضافته إلى GitHub Copilot في 14 أغسطس. راجعت benchr إعلان الإطلاق ودليل المطور وجدول التسعير وإعلان التوفر وبطاقة النموذج. هذه المصادر تثبت عقد الخدمة، لكنها لا تثبت أن النموذج سينهي مهام مستودعك بالجودة أو التكلفة المطلوبة.

ابدأ من بوابة عبء العمل

لا تجعل ترتيب الإطلاق هو قرار الشراء. السؤال الأهم: هل تستفيد مهامك من استمرار الوكيل على عدة خطوات بما يكفي لتحمل سلوك جديد وشريحة سعر أعلى بعد 200K؟ استخدم المصفوفة التالية قبل إرسال أي حركة إنتاجية.

مصفوفة قرار لتجربة Grok 4.6
نوع المهمةجرّبه عندماتوقف عندماما الذي تقيسه
تعديل برمجي متعدد الملفاتتحتاج المهمة بحثاً وتعديلاً واختبارات وتعافياً من فشل أداة عبر أدوار كثيرة.لا يفرض نظام الوكيل سقفاً للأدوار أو الصلاحيات أو التكلفة.نجاح البناء، الانحدارات، قبول المراجع، والتكلفة الكاملة لكل تغيير مقبول.
تطبيق تفاعلي أو بصريتريد جمع النص والصورة والأدوات داخل مسار واحد.قالب محدد أو نموذج أصغر ينجز المهمة بلا دورة وكيل طويلة.تغطية المتطلبات، مراجعة الواجهة، الوصول، وحجم إعادة العمل.
بحث يحتاج بيانات حديثةيمكنك تفعيل أدوات بحث الويب أو X وتسجيل نتائجها ومصادرها.لا تستطيع فصل النص المسترجع عن استنتاج النموذج أو الاحتفاظ بالمراجع.اكتمال المصادر، الادعاءات غير المسندة، ومراجعة كل مرجع مؤثر في القرار.
تحويل قصير ومتكرريثبت نفس الاختبار تحسناً واضحاً في الجودة أو سير العمل.الأولوية لسعر متوقع ومخرجات مقيدة، لا لسياق طويل ووكالة متعددة الخطوات.نجاح الـschema، مرات الإعادة، والسعر مقابل خط الإنتاج الحالي.

عتبة 200K قد تقلب القرار

رقم 2/6 دولار هو سعر البداية، وليس سعراً ثابتاً داخل نافذة 500K كلها. تعرض xAI للإدخال الأقل من 200K سعراً قدره 2 دولار، و0.50 للكاش، و6 للإخراج لكل مليون. عندما يصل البرومبت إلى 200K توكن أو يتجاوزه، تصبح القيم 4 و1 و12 دولاراً. تنطبق الشريحة الأعلى على التوكنز المفوترة في الطلب طويل السياق.

قسّم سجلاتك إلى طلبات تحت العتبة وأخرى عندها أو فوقها. احسب الحالتين في حاسبة التكلفة، ثم أضف رسوم الأدوات والمحاولات المعادة. لا تعامل نافذة السياق الكبيرة كمساحة مجانية.

غياب رقم لسقف الإخراج لا يلغي حدودك

يذكر الدليل أن إخراج النص بلا حد، لكنه لا يعطي رقماً أقصى للتوكنز. هذه فجوة موثقة، وليست إذناً بتشغيل الوكيل بلا توقف. ضع حداً للأدوار، ووقتاً أقصى، وسقف إنفاق، وقائمة أدوات مسموحة، وحجماً أقصى للملف، وقاعدة توقف عند تكرار الفشل. اطلب موافقة قبل أي حذف أو أثر خارجي.

ثبّت معرّف النموذج أثناء التقييم، وسجل البرومبت وschema الأدوات ومستوى الاستدلال. لا تقارن نتيجة بإعداد high مع خط أساس يستخدم جهداً أو أدوات مختلفة. يتيح مختبر benchr تثبيت الحالات ومعيار التقييم، لكنه لا يحتوي نتائج جاهزة لـGrok 4.6.

نتائج الإطلاق فرضية للاختبار

تنشر xAI نتيجة 69.9% على CursorBench v3.2 و65.9% على DeepSWE v1.1 للنسخة المسماة في جدولها. هذه أرقام المزوّد وليست قياسات مستقلة من benchr. تعطيك سبباً لاختبار مهام برمجية طويلة، لكنها لا تتنبأ بلغتك البرمجية أو صلاحيات المستودع أو إعداد CI أو معيار المراجعة لديك.

كوّن مجموعة إعادة تشغيل من أعمال تعرفها: إصلاح صغير، تعديل متعدد الملفات، فشل أداة يحتاج تعافياً، مهمة بصرية، وطلب طويل يتجاوز عتبة السعر. قيّم اكتمال المهمة، صحة التغيير، الانحدارات، انضباط الأدوات، المراجع عند الحاجة، وقت المراجع، والتكلفة. لا تنشر نسبة فوز ما لم تنشر الحالات والإعدادات والمخرجات الخام وطريقة الحساب.

خطّة ترحيل قابلة للرجوع

  1. ثبّت خط الأساس. احفظ النموذج الحالي والبرومبتات وتعريفات الأدوات ونسخة المستودع واختبارات القبول.
  2. أعد تشغيل الحالات نفسها. استخدم Grok 4.6 بجهد استدلال وحدود واضحة، من دون تغيير عدة عوامل معاً.
  3. راجع حالات الفشل. افحص استدعاءات الأدوات الخطرة والتغييرات الناقصة والحلقات المكلفة، لا المتوسط فقط.
  4. ابدأ بعينة منخفضة المخاطر. احتفظ بنموذج بديل وأوقف التوجيه تلقائياً عند سقوط بوابة قبول.
  5. وسّع على قيمة مقاسة. قارن العمل المقبول ووقت المراجع بإجمالي تكلفة التوكنز والأدوات والإعادة.

إذا كنت تنتقل من الإصدار السابق، ضع مراجعة Grok 4.5 بجانب تقرير الإعادة. بذلك تقارن السلوك الذي تعرفه، لا جدولين من حملتين مختلفتين.

العقد المنشور والقرار المطلوب منك
الحقلالسجل الموثققرار التشغيل
معرّف APIgrok-4.6استخدام alias أو نسخة ثابتة للتكرار
السعر الأساسي$2 إدخال / $0.50 كاش / $6 إخراج لكل 1M تحت 200Kسياسة الكاش وسقف إنفاق المهمة
شريحة السياق الطويل$4 إدخال / $1 كاش / $12 إخراج لكل 1M عند 200K فأكثرهل يظل المسار أفضل من الاسترجاع أو ضغط السياق؟
السياق والإخراج500,000 توكن؛ لا سقف رقمي منشور للإخراج النصيحدود الوقت والأدوار والإخراج والملفات
الواجهات والأدواتResponses وChat Completions ودوال ومخرجات منظمة وبحث وتنفيذ كودالصلاحيات والتسجيل وبوابات الموافقة

أسئلة شائعة

ما معرّف Grok 4.6؟

المعرّف الرسمي grok-4.6.

ما السياق وسقف الإخراج؟

السياق 500 ألف توكن؛ وتقول الوثائق لا حد نصي من دون رقم أقصى للتوكنات.

كم سعره؟

2 دولار إدخال و6 إخراج و0.50 إدخال مخزن لكل مليون، والنسخة السريعة بضعف السعر.

سجل التغييرات

  • 21 أغسطس 2026 — نُشرت الصفحة ببوابة لعبء العمل وخطة ترحيل قابلة للإعادة وحدود صريحة للدليل وشريحة السياق الطويل الموثقة.

المراجع

  1. xAI، Introducing Grok 4.6 — يثبت إصدار 12 أغسطس وأنواع العمل المستهدفة ونتائج البنشماركات وسعر البداية. آخر تحقق: 21 أغسطس 2026.
  2. سجل xAI للنموذج والتسعير — يثبت أسعار $2/$0.50/$6 الأساسية وأسعار $4/$1/$12 للسياق الطويل وعتبة 200K. آخر تحقق: 21 أغسطس 2026.
  3. دليل Grok 4.6 للمطورين — يثبت المعرّف والسياق ومستويات الاستدلال والأدوات وغياب رقم لسقف إخراج النص. آخر تحقق: 21 أغسطس 2026.
  4. xAI، Grok 4.6 in GitHub Copilot — يثبت توفره لدى الشريك في 14 أغسطس. آخر تحقق: 21 أغسطس 2026.
  5. بطاقة Grok 4.6 الرسمية — توثق حدود السلامة والتقييم المنشورة من المزوّد؛ وليست اختباراً من benchr. آخر تحقق: 21 أغسطس 2026.