GPT-Realtime-2.1: قيّم المكالمة كاملة، لا بطاقة سعر النص فقط

نموذج OpenAI صوت إلى صوت يدعم الاستدلال والأدوات؛ لكن فاتورة الصوت تحتاج اختباراً منفصلاً.

بواسطة فريق benchr · · سجل التغييرات · تحققنا من الحقائق المنشورة في المصادر الرسمية في 28 يوليو 2026

دورة صوتية متصلة تعود للاتصال حول نقطة توجيه أدوات مركزية.
لوحة نموذج من benchr GPT-Realtime-2.1 دورة صوت · أدوات · مقاطعة
رسم تحريريرسم تحريري من benchr لدورة المحادثة: المقاطعة والتعافي والأداة جزء من اختبار واحد.
النص / 1M$4الإخراج: $24
الصوت / 1M$32الإخراج: $64
السياق128Kإخراج 32K
الإصدار6 يوليو2026

أعلنت OpenAI GPT-Realtime-2.1 في 6 يوليو 2026 لتجارب الصوت متعددة الوسائط.

اختبر المحادثة، لا النص وحده

تقول OpenAI إن الإصدار أفضل في سماع الأرقام والحروف والتعامل مع الصمت والضجيج والمقاطعة. اختبر هذه الحالات كما تحدث فعلاً: قاطع النموذج، اذكر أسماء يصعب تهجئتها، واستدعِ أداة ثم عد إلى الحوار.

الصوت له فاتورة منفصلة

تسعّر OpenAI النص عند 4 دولارات للإدخال و24 دولاراً للإخراج لكل مليون توكن، والصوت عند 32 و64 دولاراً. قد يبدو النموذج رخيصاً إذا حسبت النص فقط، ثم ترتفع الفاتورة مع مدة المكالمة والصوت المخزّن. افصل كل فئة في حسابك.

سعة السياق لا تصمم المكالمة عنك

سعة 128K لا تخبرك بما يجب حفظه بعد المقاطعة أو متى تختصر سجل الحوار. اختبر مكالمة كاملة، وقِس نجاح المهمة وانتقال الأدوار والتعافي من الخطأ، لا جودة إجابة واحدة.

أهم مواصفات GPT-Realtime-2.1
الحقلالمعلومة الموثقة
معرّف APIgpt-realtime-2.1
سعر النص$4 إدخال / $24 إخراج
سعر الصوت$32 إدخال / $64 إخراج
القدراتصوت إلى صوت، استدلال، واستخدام أدوات

أسئلة شائعة

لأي استخدام صمم GPT-Realtime-2.1؟

تصفه OpenAI كنموذج صوت إلى صوت للاستدلال واستخدام الأدوات في وكلاء الصوت المعقدين.

ما سعة السياق؟

السعة المنشورة 128 ألف توكن والإخراج الأقصى 32 ألفاً.

لماذا لا أقارنه بسعر نموذج نصي؟

لأن الفوترة تفصل توكنات النص عن توكنات الصوت.

سجل التغييرات

  • 28 يوليو 2026 — نُشرت الصفحة بعد مراجعة المصادر الرسمية وتسجيل الفجوات غير المنشورة.

المراجع

  1. سجل الإصدار الرسمي للـAPI: سجل تغييرات OpenAI API
  2. توثيق النموذج والأسعار الرسمي: صفحة GPT-Realtime-2.1