مراجعة GPT-5.5: هل تستحق الترقية من GPT-5؟

وضعت OpenAI التحسينات في البرمجة الوكيلية واستخدام الحاسوب، مقابل سعر إدخال أعلى بأربع مرات من GPT-5. من يرقّي الآن، ومن ينتظر؟

من فريق benchr · · عرض سجل التغييرات · أُعيد فحص الأرقام في صفحات OpenAI الرسمية في 29 يوليو 2026

benchr rating: 4.6 / 5

ثلاثة مسارات أدلة مختلفة تمر عبر إطار معايرة بنفسجي إلى نقطة نهاية مشتركة.
لوحة نموذج من benchr GPT-5.5 إشارات متعددة · تقييم مضبوط
رسم تحريريرسم تحريري من benchr لمراجعة رائدة مبنية على إشارات تشغيلية متعددة، لا ترتيب واحد.
أُعلن عنه أبريل 2026 GPT-5.5 وGPT-5.5 Pro
تكلفة الإدخال / 1M $5.00 $30 للإخراج، ونحو 4× سعر إدخال GPT-5 ($1.25)
Terminal-Bench 2.0 82.7% معلن من OpenAI (المزود)
السياق 1M نحو 1.05M رمز، وإخراج حتى 128K

السؤال مع GPT-5.5 ليس هل هو جيد. السؤال هل الانتقال من GPT-5 يستحق كلفته، لأن OpenAI رفعت سعر API كثيراً للوصول إلى هذه القفزة. سعر GPT-5.5 هو $5 للإدخال و$30 للإخراج لكل مليون رمز؛ وسعر GPT-5 في وثائق نماذج OpenAI الرسمية هو $1.25 للإدخال و$10 للإخراج، ما يجعل GPT-5.5 أعلى بنحو 4 مرات في الإدخال و3 مرات في الإخراج. هذا بند تكلفة حقيقي لأي جهة تعمل بحجم استخدام كبير، ويغيّر السؤال من: "هل GPT-5.5 أفضل؟" إلى: "هل هو أفضل في العمل الذي تنجزه يومياً بما يكفي لتبرير فرق السعر؟"

القراءة الصريحة أن الترقية ضيقة ومقصودة. ركزت OpenAI عليها في الأماكن التي كانت النماذج أضعف فيها، وحيث يتجه الإنفاق: البرمجة الوكيلية واستخدام الحاسوب، أي أن يكتب النموذج الكود وينقحه، ويدير البرامج، ويواصل استخدام الأدوات عبر خطوات كثيرة حتى تكتمل المهمة. إذا كان هذا هو عبء العمل لديك فالحجة قوية. وإذا لم يكن كذلك، فالحجة تضعف بسرعة. مراجعة benchr السابقة لـ GPT-5 تنتهي إلى مزيج يستخدم أكثر من نموذج لمعظم الفرق؛ وGPT-5.5 لا يقلب هذه الخلاصة بقدر ما يحدد بدقة أين يستحق مفتاح OpenAI مكانه.

ما الذي تغيّر داخليًا؟

تقدّم OpenAI نموذج GPT-5.5 بوصفه "فئة جديدة من الذكاء" للبرمجة الوكيلية والعمل المعرفي الاحترافي. إذا أزلنا لغة التسويق، فالادعاء العملي هو التالي: النموذج أفضل في البقاء مع المهمة عبر خطوات كثيرة، وقراءة المخرجات، وتحديد الإجراء التالي، وعدم فقدان الخيط في منتصف حلقة طويلة من استخدام الأدوات. هذا هو نمط الفشل الذي منع الوكلاء من أن يكونوا موثوقين، وهو المحور الذي تتراكم فيه المكاسب الصغيرة طوال الجلسة.

تدعم أرقام المزوّد هذا التموضع، مع تحفظ مهم. تنشر صفحة OpenAI الرسمية 82.7% في Terminal-Bench 2.0 و78.7% في OSWorld-Verified و58.6% في SWE-bench Pro. أصبحت الأرقام منسوبة مباشرة إلى المصدر، لكنها تظل تقييمات أجراها المزوّد وليست قياسات مستقلة من benchr.

GPT-5.5 مقابل GPT-5 في معايير البرمجة واستخدام الحاسوب (أرقام معلنة من OpenAI)، مايو 2026
المعيارGPT-5.5GPT-5
Terminal-Bench 2.0 (برمجة وكيلية / الطرفية)82.7%غير منشور على هذا الإصدار
OSWorld-Verified (استخدام الحاسوب)78.7%غير منشور على هذا الإصدار
SWE-bench Pro58.6%غير منشور على هذا الإصدار

يعرض الجدول نسخ الاختبارات التي نشرتها OpenAI لـGPT-5.5 تحديدًا. لا توجد في السجل المفحوص أرقام GPT-5 على القصّات نفسها، لذلك تبقى خلايا المقارنة فارغة بدل خلط أطر اختبار مختلفة. ولا تنشر OpenAI رقم 88.7% المتداول لـSWE-bench Verified في سجل الإطلاق المفحوص، لذلك يظل خارج الصفحة.

السعر ارتفع. هل ارتفعت القيمة؟

هذه هي العقدة. عند $5 / $30 لكل مليون رمز، يعمل GPT-5.5 بسعر إدخال أعلى بنحو 4 مرات من GPT-5 وسعر إخراج أعلى بنحو 3 مرات. تصف OpenAI GPT-5.5 بأنه أكثر كفاءة في استخدام الرموز من أسلافه، لذلك لا ترتفع الكلفة الفعلية للمهمة دائماً بنسبة السعر المعلن نفسها؛ لكن مقدار الفائدة يعتمد بالكامل على عبء عملك، وهو أول ما يجب قياسه قبل الانتقال.

ولنافذة السياق 1.05M حد سعري مهم: إذا تجاوز الطلب 272K من رموز الإدخال، تطبق OpenAI معامل 2× على سعر الإدخال و1.5× على سعر الإخراج للجلسة كاملة. لذلك $5 / $30 هو سعر السياق القياسي، لا سعرًا ثابتًا على امتداد النافذة كلها.

في أعمال الوكلاء، قد تميل الحسابات لصالح الترقية رغم السعر الأعلى. النموذج الذي ينهي مهمة متعددة الخطوات في تشغيل نظيف واحد أرخص من نموذج أرخص يتوقف ويتراجع ويحرق محاولة ثانية كاملة. ضريبة إعادة المحاولة هي المكان الذي تنزف فيه ميزانيات الوكلاء بهدوء. إذا خفّض سلوك GPT-5.5 الأكثر ثباتاً في الحلقات الطويلة معدل التشغيلات الفاشلة لديك، فقد يتفوّق السعر الأعلى لكل رمز في الفاتورة المهمة فعلاً: فاتورة العمل المنجز. مقارنة benchr بين GPT-5 وClaude Opus تشرح كيف تقلب اقتصاديات المهمة نفسها القرار بين النماذج المتقدمة، والمنطق نفسه ينطبق داخل تشكيلة OpenAI.

أما كل ما ليس وكيلياً، فالدفاع عن السعر الإضافي أصعب. المحادثة، والطلبات القصيرة، والتصنيف، والمسودات بضربة واحدة: لا يعتمد أي منها على قوة الحلقات الطويلة التي بُني GPT-5.5 حولها، وبالتالي ستدفع ضريبة البرمجة الوكيلية على عمل لا يستخدمها. لهذا النمط يبقى GPT-5 أفضل من حيث القيمة، ولا يهم سعر الإدخال المخبأ في GPT-5.5 عند $0.50 لكل مليون إلا إذا كنت تعيد استخدام سياقات ثابتة كبيرة. إذا كانت فاتورتك حساسة، فإن دليل benchr عن خفض استخدام الرموز سيؤثر أكثر من تبديل النموذج.

نموذجان باسم "5.5" لا تخلط بينهما

هناك منتجان منفصلان يحملان شارة 5.5. الأول هو GPT-5.5 الرئيسي ومعه GPT-5.5 Pro الأعلى حوسبة؛ السعر الرسمي للقاعدة $5 / $30 ولسعر Pro ‏$30 / $180. والثاني GPT-5.5 Instant، وهو نموذج أسرع موجّه لتجربة ChatGPT وchat-latest. هذه المراجعة تغطي النموذج الرئيسي، لا Instant.

سبب أهمية ذلك في قرار الترقية: إذا كنت من مستخدمي ChatGPT، فقد تكون على GPT-5.5 Instant افتراضياً من دون أن تلمس النموذج الرئيسي أصلاً. رؤية "5.5" في واجهة المحادثة لا تعني أنك تشغّل النموذج الذي تتصدر أرقامه في Terminal-Bench وOSWorld هذه الصفحة. النموذج الرئيسي يعيش في API وCodex، ووصل إلى باقات ChatGPT المدفوعة (Plus وPro وBusiness وEnterprise)، مع قصر GPT-5.5 Pro على Pro وBusiness وEnterprise.

من يرقّي، ومن ينتظر؟

اختر GPT-5.5 إذا كنت تبني أو تشغّل وكلاء: نموذج داخل حلقة طرفية، أو وكيل برمجة يغلق تذاكر عبر مستودع، أو إعداد استخدام حاسوب يدير برنامجاً عبر مهمة متعددة الخطوات. هذا هو جوهر الإصدار، وهنا تتطابق أرقام المزود مع نية التصميم. اقرنه بطبقة Batch ($2.50 / $15.00) لأي تشغيل وكيل غير تفاعلي يحتمل تأخر النتيجة، وسيصبح السعر الإضافي أسهل قبولاً.

استخدم GPT-5.5 Pro فقط عندما تكون المهمة صعبة بما يكفي لأن يستحق معدل نجاح أعلى سعره الرسمي $30 / $180 لكل مليون: تنقيح أعطال معقدة أو عمل متعدد الخطوات عالي المخاطر تكون فيه المحاولة الفاشلة الثانية أغلى من علاوة الرموز. لمعظم الفرق هو أداة متخصصة تستدعيها عمداً، لا خياراً افتراضياً.

ابقَ على GPT-5 عندما يكون عملك محادثة أو نصوصاً قصيرة أو تنفيذاً بضربة واحدة، حيث لا تُستخدم ميزة GPT-5.5 في الحلقات الطويلة أصلاً وستدفع أكثر مقابل هامش لا تلمسه. وإذا كنت تقارن GPT-5.5 بمختبرات النماذج المتقدمة الأخرى لا بسابقه فقط، فسباق البرمجة الوكيلية متقارب جداً الآن. مراجعة benchr لـ Claude Opus 4.8 تغطي أقوى موقع منافس في أعمال الطرفية واستخدام الحاسوب، والفارق بينهما ضيق بما يكفي لأن تختبرهما على مهامك قبل أن تخصص ربع إنفاق الوكلاء لأي منهما.

الخلاصة

GPT-5.5 هو أنظف نموذج أطلقته OpenAI حتى الآن للبرمجة الوكيلية واستخدام الحاسوب، وأرقام المزود تشير إلى الاتجاه نفسه الذي يشير إليه السعر: نحو الوكلاء. كترقية موجّهة يستحق تقييماً عالياً. أما كقرار عام من نوع "استبدل GPT-5 في كل مكان"، فلا يثبت الحالة؛ لأن المكاسب لا تظهر في عمل لا يعتمد على استخدام أدوات متعدد الخطوات، بينما ترتفع الفاتورة في كل الأحوال.

نصيحة الشراء بسيطة. وجّه حركة الوكلاء وحلقات البرمجة إلى GPT-5.5، وأبقِ GPT-5 الأرخص لكل رمز للمحادثة والعمل بضربة واحدة، واحجز GPT-5.5 Pro لعدد قليل من المهام التي يكون فيها معدل نجاح أعلى أهم من فاتورة أكبر. قِس معدل التشغيلات الفاشلة قبل التبديل وبعده؛ هذا الرقم، لا لوحة الترتيب، هو ما يخبرك هل دفعت الترقية قيمتها.

أسئلة شائعة

هل يستحق GPT-5.5 الترقية من GPT-5؟

إذا كان عملك برمجة وكيلية أو استخداماً للحاسوب، بحيث يقود النموذج الطرفية أو يدير برامج عبر خطوات كثيرة، فنعم. هذا هو المكان الذي ركزت فيه OpenAI الترقية، مع أرقام معلنة من المزود تبلغ 82.7% في Terminal-Bench 2.0 و78.7% في OSWorld-Verified. إذا كان عملك طلبات قصيرة أو محادثة أو توليداً بضربة واحدة، فمن الأصعب تبرير المكاسب مع سعر API أعلى بكثير.

كم يكلف GPT-5.5 مقارنة بـ GPT-5؟

السعر الرسمي لـGPT-5.5 هو $5 للإدخال و$30 للإخراج لكل مليون، مع إدخال مخبأ عند $0.50 وBatch عند $2.50 / $15. وسعر GPT-5.5 Pro الرسمي هو $30 / $180. وفوق 272K من رموز الإدخال، يطبق OpenAI معامل 2× على الإدخال و1.5× على الإخراج للجلسة كاملة.

ما الفرق بين GPT-5.5 وGPT-5.5 Instant؟

يشتركان في اسم 5.5 لكنهما منتجان مختلفان. GPT-5.5 الرئيسي (ومعه GPT-5.5 Pro) هو نموذج البرمجة والعمل الاحترافي العالي في API، وأُعلن عنه في 23 أبريل 2026. أما GPT-5.5 Instant فهو نموذج ChatGPT الافتراضي السريع الذي حل محل GPT-5.3 Instant في 5 مايو 2026. لا تخلط بينهما: هذه المراجعة تغطي النموذج الرئيسي.

ما حجم سياق GPT-5.5؟

وفق وثائق نماذج المطورين من OpenAI، لديه سياق بحجم 1,050,000 رمز، ويُختصر غالباً إلى 1M، مع إخراج يصل إلى 128,000 رمز. وكما في أي نموذج طويل السياق، يكون الاسترجاع داخل النافذة أكثر موثوقية من محاولة تلخيص كل شيء بضربة واحدة، لذلك تحقق على عبء عملك.

هل أرقام معايير GPT-5.5 موثقة مستقلاً؟

لا. تنشر OpenAI نفسها 82.7% في Terminal-Bench 2.0 و78.7% في OSWorld-Verified و58.6% في SWE-bench Pro. هي أرقام مصدرها مباشر، لكنها تظل تقييمات مزوّد لا قياسات مستقلة من benchr.

سجل التغييرات

  • 29 يوليو 2026 — أُعيد فحص صفحات OpenAI الحالية. استُبدلت المصادر الناقلة بمصادر أولية، وثُبت سعر GPT-5.5 Pro عند $30 / $180، وأضيف معامل السياق الطويل فوق 272K من رموز الإدخال.
  • 30 مايو 2026 — نُشرت النسخة الأولى وصُححت في اليوم نفسه. تم التحقق من أسعار GPT-5.5 وسياقه وأقصى إخراج له وفق وثائق نماذج المطورين من OpenAI (developers.openai.com/api/docs/models/gpt-5.5)؛ أما أرقام المعايير فهي معلنة من OpenAI عبر مقالات طرف ثالث تستشهد بإعلان الإطلاق. ذكرت نسخة سابقة خطأ أن تكلفة GPT-5 هي "$2.50/$15.00" ووصفت GPT-5.5 بأنه "نحو ضعف" سعر GPT-5؛ صُحح ذلك وفق صفحة نموذج GPT-5 الرسمية من OpenAI (developers.openai.com/api/docs/models/gpt-5)، التي تعرض GPT-5 بسعر $1.25 للإدخال و$10.00 للإخراج لكل مليون رمز، ما يجعل GPT-5.5 أعلى بنحو 4 مرات في الإدخال و3 مرات في الإخراج.

المراجع

  1. OpenAI، "وثائق نموذج GPT-5.5"، developers.openai.com/api/docs/models/gpt-5.5، اطُّلع عليه في 29 يوليو 2026.
  2. OpenAI، "وثائق نموذج GPT-5.5 Pro"، developers.openai.com/api/docs/models/gpt-5.5-pro، اطُّلع عليه في 29 يوليو 2026.
  3. OpenAI، "تقديم GPT-5.5"، openai.com/index/introducing-gpt-5-5، اطُّلع عليه في 29 يوليو 2026 — جدول المعايير ومعلومات الإطلاق المنشورة من المزوّد.
  4. OpenAI، "GPT-5.5 Instant"، openai.com/index/gpt-5-5-instant، اطُّلع عليه في 29 يوليو 2026.