فارق السعر بين النموذجين صغير في كثير من أنماط الاستخدام، لكنه ليس صفرًا ويتغيّر مع نسبة الإدخال إلى الإخراج. لذلك تبدأ المقارنة من الكلفة، ثم تنتقل إلى الحدود والميزات والكمون المقاس على منطقة النشر نفسها.
المواصفات في جدول واحد
| البُعد | GPT-5 | Gemini 3.5 Flash |
|---|---|---|
| الإدخال / 1M | $1.25 | $1.50 |
| الإخراج / 1M | $10.00 | $9.00 |
| الإدخال المخزَّن / 1M | $0.125 | $0.15 |
| طبقة API مجانية | لا | نعم |
| سعة السياق | 400,000 | 1,048,576 |
| أقصى إخراج | 128,000 | 65,536 |
الكمون يحتاج اختبار نشر
لا ينشر المزوّدان رقمًا عامًا موحدًا للتوكنات في الثانية أو زمن أول توكن يمكن مقارنته مباشرة بين هذين النموذجين، ولم يجرِ benchr دراسة مضبوطة عبر المناطق. حُذفت القيم السابقة غير الموثقة. اختبر التعليمات وأطوال الإخراج والإعدادات والتوازي نفسها، وقارن p50 وp95 وp99 في بيئة النشر المستهدفة.
أين يصمد GPT-5
أقصى إخراج GPT-5 المدرج عند 128K أكبر من سقف Flash المدرج عند 65,536 توكن، وقد يهم ذلك لتوليدات الشيفرة أو المستندات الطويلة. تنشر OpenAI رقم SWE-bench لـGPT-5، بينما لا تنشر مواد Google التي راجعناها رقم SWE-bench Verified قابلًا للمقارنة مباشرة لـGemini 3.5 Flash. شغّل النموذجين على مهام المستودع والإعدادات نفسها بدل ملء الفراغ بتقدير.
الطبقة المجانية قد تغيّر القرار
تتيح Google طبقة مجانية لـGemini API، بينما لا تعرض OpenAI طبقة مماثلة لـGPT-5. قد تكون هذه نقطة عملية للنموذج الأولي أو الأداة الداخلية منخفضة الاستخدام، لكن الحدود والحصص وسياسة البيانات قد تختلف عن الطبقة المدفوعة. اختبر عليها، ثم أعد الحساب قبل نقل الاستخدام إلى الإنتاج. وتعرض مقارنة الأدوات المجانية أهم القيود.