فارق السعر بين النموذجين صغير في كثير من أنماط الاستخدام، لكنه ليس صفرًا ويتغيّر مع نسبة الإدخال إلى الإخراج. لذلك تبدأ المقارنة من الكلفة، ثم تنتقل إلى الحدود والميزات والكمون المقاس على منطقة النشر نفسها.
المواصفات في جدول واحد
| البُعد | GPT-5 | Gemini 3.5 Flash |
|---|---|---|
| الإدخال / 1M | $1.25 | $1.50 |
| الإخراج / 1M | $10.00 | $9.00 |
| الإدخال المخزَّن / 1M | $0.125 | $0.15 |
| طبقة API مجانية | لا | نعم |
| سعة السياق | 400,000 | 1,048,576 |
| أقصى إخراج | 128,000 | 65,536 |
| أول توكن | 520ms تقدير تحريري من benchr | 195ms تقدير تحريري من benchr |
| الإنتاجية | 90 tok/s تقدير تحريري من benchr | 289 tok/s تقدير تحريري من benchr |
الكمون يحتاج اختبار نشر
قيم 195ms و289 توكن/ث و520ms و90 توكن/ث تقديرات تخطيطية من benchr مشتقة من تقارير عامة. ليست قياسات مضبوطة ولا ضمانات من المزوّدين، وقد تتغيّر بحسب المنطقة والضغط وشكل الطلب والإعدادات. لا تستنتج منها أفضلية ثابتة؛ اختبر التعليمات وأطوال الإخراج نفسها في بيئة النشر المستهدفة.
أين يصمد GPT-5
أقصى إخراج GPT-5 المدرج عند 128K أكبر من سقف Flash المدرج عند 65,536 توكن، وقد يهم ذلك لتوليدات الشيفرة أو المستندات الطويلة. في البرمجة، لدى GPT-5 رقم SWE-bench منشور من المزوّد في البيانات، فيما قيمة Flash البالغة 80.6% تقدير تحريري من benchr. لا يجوز التعامل مع نوعَي المصدر هذين كمقارنة مباشرة مقاسة؛ شغّل النموذجين على مهام المستودع نفسها.
الطبقة المجانية قد تغيّر القرار
تتيح Google طبقة مجانية لـGemini API، بينما لا تعرض OpenAI طبقة مماثلة لـGPT-5. قد تكون هذه نقطة عملية للنموذج الأولي أو الأداة الداخلية منخفضة الاستخدام، لكن الحدود والحصص وسياسة البيانات قد تختلف عن الطبقة المدفوعة. اختبر عليها، ثم أعد الحساب قبل نقل الاستخدام إلى الإنتاج. وتعرض مقارنة الأدوات المجانية أهم القيود.