أطلقت OpenAI نموذج GPT-5 في أغسطس 2025، وفق منشور الإطلاق من OpenAI. كان GPT-5 قفزة كبيرة عن GPT-4o، ولا أحد ينازع في ذلك. السؤال الحقيقي هو هل ما زال ينبغي أن تدفع له بعدما أصبح Claude Opus 4.7 وعائلة Gemini 3 مطروحين أيضاً. في أعمال محددة، نعم. تشرح هذه المقالة أي أعمال تحديداً، بالاعتماد على سجل المعايير المنشور، وتموضع OpenAI نفسه، وأنماط المقارنة الظاهرة علناً بين المختبرات الثلاثة المتقدمة.
تضع OpenAI نموذج GPT-5 عبر الاستدلال وتعدد الوسائط والمخرجات المنظمة والمحادثة. لا تملك الصفحة مجموعة مضبوطة قابلة للنشر تثبته الأكثر مرونة أو ثقة أو خطأً مقارنة بالنماذج المتقدمة الأخرى. هذه أسئلة تقييم لا حقائق مفترضة.
كيف تضع OpenAI النموذج
تركز مواد إطلاق GPT-5 من OpenAI على ثلاثة أمور ينبغي وزنها بعناية. الأول جودة التفكير في الرياضيات وحل المسائل المنظمة (تعلن الشركة أداءً قوياً في معيار MATH وسلوكاً محسناً في سلاسل التفكير). الثاني اتساع تعدد الوسائط، إذ يغطي الرؤية والصوت والنص في نموذج واحد، مع وضع جودة الرؤية على أنها الأفضل في فئتها. الثالث هو "دفء المحادثة"، وهو مصطلح الشركة لطريقة تعامل النموذج مع التفاعل المفتوح.
هذه ادعاءات تموضع من المزود لا تحققاً مستقلاً. استخدمها لاختيار طبقات الاختبار، ثم شغّل الإصدارات الحالية على مدخلاتك وأدواتك وقيود السلامة ومعايير القبول قبل تحديد موقع النموذج.
البرمجة: اختبر الصحة بعد الترجمة
تعلن OpenAI نحو 74.9% لـGPT-5 على SWE-bench Verified في لقطة الإطلاق المذكورة، بينما تعلن Anthropic نتيجة مختلفة لـOpus 4.7. قد تستخدم أرقام المزودين إعدادات مختلفة ولا تثبت معدل نجاح مستودعك. كما أن نقاش المجتمع ليس إعادة مستقلة.
أنشئ تقييماً للمستودع يتجاوز الترجمة: حالات طرفية وحدود تقطيع وتزامن وواجهات غير مألوفة واختبارات انحدار وقائمة ملفات مسموحة. أعط كل نموذج الحالة والمطالبة والأدوات وميزانية الإعادة والمهلة نفسها، وسجّل اجتياز الاختبارات وواجهات API المخترعة والتغييرات غير المصرح بها ودقائق المراجعة والكمون والرموز.
اشترط مراجعة بشرية واختبارات آلية لتغييرات الإنتاج أياً كان النموذج. قارن GPT وClaude بالبروتوكول نفسه بدلاً من اعتبار أحدهما أكثر أماناً بطبيعته. تستخدم مراجعة Opus 4.7 حد الأدلة نفسه.
اجتياز الترجمة ليس إثبات صحة؛ اختبر الحالات الطرفية وراجع التغيير أياً كان النموذج.
الكتابة والتصميم واتساع المحادثة
الكتابة المفتوحة والتصميم فئتان مناسبتان لتقييم GPT-5 لأن OpenAI تضعه فيهما. قارن مسودات مجهولة الهوية من موجز واحد وسجّل الصوت والوفاء الواقعي وإمكانية الوصول والالتزام بالسياسة ووقت التحرير. لا تدعي الصفحة فائزاً مقاساً للمسودة الأولى.
للمهام التي تكون فيها المرونة الأسلوبية مركزية، عرّف السلم قبل التوليد واستخدم مراجعين لا يعرفون هوية النموذج. لا تجعل الطلاقة بديلاً عن صحة الادعاءات أو ضوابط العلامة.
لا تستنتج جودة لغة أو لهجة من وصف متعدد اللغات. أنشئ طبقة مراجعة معماة لكل لغة وسوق، بما فيها العربية الدارجة، وقِس المعنى والسجل والقواعد والإضافات غير المدعومة ووقت التحرير بمراجعين متمكنين. يقدم دليل المحتوى العربي بروتوكولاً قابلاً للإعادة.
الهلوسة التقنية المتخصصة
واجهات API المخترعة أو القديمة فرضية فشل يجب اختبارها لكل نموذج. ثبّت إصدارات المكتبات وخذ عينات من APIs شائعة وأقل شيوعاً وافحص كل رمز مقابل الوثائق الرسمية أو المترجم. أبلغ معدلات الاختراع والامتناع بدلاً من نسب تكرار مقارن بلا مجموعة مضبوطة.
تحقق من ادعاءات API في المصادر الأساسية والاختبارات أياً كانت نبرة النموذج. للأطر المتخصصة والقديمة، اشترط إحالات أو بحثاً بالأداة وسجّل عدم اليقين والامتناع وقارن المرشحين الحاليين في الإعداد نفسه.
كم يكلف؟
في لقطة الأسعار المتحقق منها هنا، تسرد OpenAI GPT-5 عند $1.25 لكل مليون إدخال و$10 لكل مليون إخراج وفق صفحة الأسعار. سعر الرمز ليس تكلفة السير الكاملة. قارن الإدخال والإخراج والتخزين وملاءمة Batch والإعادات والأدوات والكمون والفشل وعمل المراجعة، وتحقق من الصفحة الحية قبل شراء السعة. تقدم مقالة السعر حسب حالة الاستخدام إطار الحساب.
| الطبقة | الإدخال ($/مليون رمز) | الإخراج ($/مليون رمز) | ملاحظات |
|---|---|---|---|
| GPT-5 | $1.25 | $10 | الطبقة المتقدمة القياسية |
| GPT-5 Mini | $0.25 | $2.00 | نموذج مقطر للاستخدام الكثيف |
| GPT-5 (Batch API) | $0.625 | $5.00 | خصم 50% من السعر القياسي $1.25/$10؛ معالجة غير متزامنة |
للأحمال التي لا تحتاج استجابة متزامنة، مثل معالجة المستندات ليلًا أو تصنيف دفعات كبيرة، يخفض خصم Batch API البالغ 50% سعر GPT-5 من $1.25/$10 القياسي إلى $0.625/$5 لكل مليون رمز إدخال/إخراج. تحقّق من نافذة المعالجة الحالية والأهلية في وثائق OpenAI قبل التخطيط لدفعة إنتاجية.
أين يستحق GPT-5 مكانه؟
الفئات التالية مرشحون لاختبار GPT-5 وليست أحكام اختيار عامة.
للعمل البصري والتصميم مثل صفحات الهبوط والعروض والتخطيطات، أدرج GPT-5 لأن OpenAI تضعه للعمل متعدد الوسائط. استخدم موجزاً وأصولاً مرجعية واحدة، وقِس تغطية المتطلبات وإمكانية الوصول والعيوب البصرية والدقة ووقت التحرير.
للكتابة المفتوحة ومطابقة الصوت، شغّل مراجعة معماة على الموجز نفسه وسجّل الصوت والانضباط الواقعي والادعاءات الممنوعة ووقت التحرير وتفضيل المراجع؛ ولا تعيّن افتراضياً من انطباع غير مقاس.
للعمل متعدد اللغات، اختبر كل لغة وسجلاً إقليمياً منفصلين بمراجعين متمكنين. لا يثبت وصف المزود ولا هذه المقالة خياراً أول أكثر أماناً عبر اللغات.
أين تتجاوزه؟
لمراجعة كود الإنتاج، قارن المرشحين على أخطاء مزروعة وتاريخية مع اشتراط الاختبارات والموافقة البشرية. قِس الكشف والإيجابيات الكاذبة وواجهات API المخترعة والتعديلات غير الآمنة ووقت المراجع؛ ولا تستبعد أو تفضل نموذجاً من النبرة.
للعمل عالي المخاطر كالطبي والقانوني والمالي، لا تعتمد على نموذج واحد أو نبرة الثقة. استخدم مصادر أولية ومراجعة مختص وفحوصاً خاصة بالمجال وسياسة امتناع وتصعيد واضحة.
لتركيب السياق الطويل، ضع حقائق بإجابات مرجعية على أعماق مختلفة وقارن صحة الإحالات والفقد والادعاءات غير المدعومة والاتساق تحت ميزانية رموز متساوية. لا تثبت السعة القصوى وتموضع المزود فائزاً.
الخلاصة التي لم تتغير
GPT-5 مرشح حالي بين عدة مرشحين. تبرر أسعار OpenAI الموثقة وتموضعها ومعاييرها المعلنة إدراجه في المقارنة؛ ولا تثبت ترتيباً أو أفضلية سرعة أو صدارة أسلوبية أو اتساعاً لغوياً أو معدل فشل خاصاً بالنموذج.
اختر نموذجاً واحداً أو عدة نماذج أو موجهاً فقط بعد قياس نجاح المهمة والسلامة ووقت المراجعة والموثوقية والكمون والتكلفة الكلية. يضيف إعداد مزودين مرونة لكنه يضيف أيضاً تعقيد التوجيه والخصوصية والتشغيل والفوترة؛ وليس توصية عامة.
إذا فرضت التكلفة نموذجاً واحداً، فدع مجموعة القبول الممثلة تختار، لا تقسيم «كتابة مقابل برمجة» غير المقاس. أعد الاختبار عند تغير الإصدار أو المطالبة أو الأدوات.