تفصيل التسعير
| الطبقة | السعر / مليون توكن |
|---|---|
| إدخال قياسي | $1.250 |
| إدخال مخزَّن مؤقتًا | $0.125 |
| إخراج قياسي | $10.000 |
| سعة السياق | 400,000 توكن |
| أقصى إخراج | 128,000 توكن |
سقف السياق عند 400 ألف
حد الـ400 ألف توكن في GPT-5 أدنى من معيار المليون الذي رسّخته Claude وDeepSeek وGemini. في معظم الأعمال اليومية لا يلمس المستخدم هذا الحد أصلًا. لكنه يصبح عائقًا حقيقيًا في ثلاث حالات: تحليل مستودع برمجي كبير بكامله، أو تمرير عقد قانوني طويل دفعة واحدة، أو إدارة محادثة وكيل ممتدة بلا اقتطاع. إن كنت تقترب بانتظام من 300 ألف توكن من السياق في الاستدعاء الواحد، فالسقف قيد وظيفي يستحق التخطيط له، لا تفصيلًا نظريًا.
سعر الإدخال المخزَّن مؤقتًا
تسجّل صفحة GPT‑5 الرسمية سعرًا قدره $0.125 لكل مليون توكن من الإدخال المخزَّن مؤقتًا، أي أقل بنسبة 90% من سعر الإدخال القياسي البالغ $1.25. يفيد ذلك عندما يعيد الوكيل استخدام بادئة مؤهلة كبيرة، لكن الوفر الفعلي يعتمد على تحقق إصابة الكاش ونسبة النص المتكرر ومزيج الإدخال والإخراج.
المهام التي ينبغي اختباره عليها
ضع الكتابة والتلخيص والإجابة عن الأسئلة والتحليل ضمن مجموعة الاختبار. أما نتيجة 74.9% على SWE-bench فهي إشارة خاصة بإعداد برمجي محدد، ولا تثبت جودة مستودعك أو مقدار المراجعة البشرية المطلوبة. قِس النجاح على مهام ممثلة قبل اعتماد النموذج.
سيناريوهات التكلفة
عند 10 ملايين توكن إدخال و3 ملايين إخراج شهريًا: 12.50 دولار إدخال + 30 دولارًا إخراج = 42.50 دولار شهريًا. وعند 100 مليون + 30 مليونًا: 425 دولارًا شهريًا. هذه الأرقام أدنى بكثير من Claude Sonnet (540 دولارًا شهريًا) أو GPT-5.5 (1,250 دولارًا شهريًا) عند الحجم نفسه، وهذا تحديدًا سبب استقرار معظم الفرق هنا كنقطة بداية افتراضية.
ملاءمة الاستخدام
مرشح لـ: المهام النصية العامة، ومساعدات البرمجة التي تخضع للمراجعة، والتطبيقات المبنية على أدوات OpenAI حين تكفي نافذة 400 ألف توكن.
قارن بديلاً إذا: احتجت سياقاً أطول، أو استدلالاً أعلى في اختباراتك، أو تكلفة أقل للأحمال البسيطة عالية الحجم.
عند 1.25 دولار للإدخال و10 دولارات للإخراج، يجب أن يُحكَم على GPT-5 بإجمالي تكلفة المهمة لا بسعر الإدخال المُعلن وحده. البرومبتات الطويلة والإعادات والمخرجات الكثيفة قد تجعل سعر الإخراج هو المهيمن على الفاتورة. وحد السياق عند 400 ألف توكن نافع فقط طالما بقيت جودة الاسترجاع وزمن الاستجابة مقبولين على وثائقك أنت. للتقييم المرتكز على البرمجة، قارن رقم 74.9% على SWE-bench مقابل تكلفة المراجعة البشرية المتوقعة لديك.
قائمة قرار
قبل توجيه حركة إنتاج إلى GPT-5، شغّل تقييمًا صغيرًا يطابق الحمل الذي تدفع مقابله فعلًا: طول البرومبت، طول الإخراج المتوقع، إعادة استخدام التخزين المؤقت، سلوك الإعادة، ومعدّل المراجعة البشرية. البنشمارك العام إشارة مفيدة، لكنه لا يخبرك إن كان هذا النموذج أرخص لاستدعاءاتك أنت.
قِسه مقابل خيار أرخص وخيار أقوى؛ هذه الطبقة تحديدًا هي حيث توفّر قواعد التوجيه مالًا أكثر من اختيار افتراضي واحد. ومع OpenAI بالذات، تحقّق من معرّف النموذج الحيّ وحدود المعدّل وأي قيود توفّر إقليمية قبل اعتبار السعر المعلن تكلفة الإنتاج النهائية.