GPT-Realtime-2.1: قيّم المكالمة كاملة، لا بطاقة سعر النص فقط
نموذج OpenAI صوت إلى صوت يدعم الاستدلال والأدوات؛ لكن فاتورة الصوت تحتاج اختباراً منفصلاً.
بواسطة فريق benchr · · سجل التغييرات · تحققنا من الحقائق المنشورة في المصادر الرسمية في 28 يوليو 2026
OPENAI · REALTIME2.1صوت فوري · أدوات
لوحة نموذج من benchrGPT-Realtime-2.1دورة صوت · أدوات · مقاطعة
رسم تحريريرسم تحريري من benchr لدورة المحادثة: المقاطعة والتعافي والأداة جزء من اختبار واحد.
النص / 1M$4الإخراج: $24
الصوت / 1M$32الإخراج: $64
السياق128Kإخراج 32K
الإصدار6 يوليو2026
أعلنت OpenAI GPT-Realtime-2.1 في 6 يوليو 2026 لتجارب الصوت متعددة الوسائط.
اختبر المحادثة، لا النص وحده
تقول OpenAI إن الإصدار أفضل في سماع الأرقام والحروف والتعامل مع الصمت والضجيج والمقاطعة. اختبر هذه الحالات كما تحدث فعلاً: قاطع النموذج، اذكر أسماء يصعب تهجئتها، واستدعِ أداة ثم عد إلى الحوار.
الصوت له فاتورة منفصلة
تسعّر OpenAI النص عند 4 دولارات للإدخال و24 دولاراً للإخراج لكل مليون توكن، والصوت عند 32 و64 دولاراً. قد يبدو النموذج رخيصاً إذا حسبت النص فقط، ثم ترتفع الفاتورة مع مدة المكالمة والصوت المخزّن. افصل كل فئة في حسابك.
سعة السياق لا تصمم المكالمة عنك
سعة 128K لا تخبرك بما يجب حفظه بعد المقاطعة أو متى تختصر سجل الحوار. اختبر مكالمة كاملة، وقِس نجاح المهمة وانتقال الأدوار والتعافي من الخطأ، لا جودة إجابة واحدة.
أهم مواصفات GPT-Realtime-2.1
الحقل
المعلومة الموثقة
معرّف API
gpt-realtime-2.1
سعر النص
$4 إدخال / $24 إخراج
سعر الصوت
$32 إدخال / $64 إخراج
القدرات
صوت إلى صوت، استدلال، واستخدام أدوات
أسئلة شائعة
لأي استخدام صمم GPT-Realtime-2.1؟
تصفه OpenAI كنموذج صوت إلى صوت للاستدلال واستخدام الأدوات في وكلاء الصوت المعقدين.
ما سعة السياق؟
السعة المنشورة 128 ألف توكن والإخراج الأقصى 32 ألفاً.
لماذا لا أقارنه بسعر نموذج نصي؟
لأن الفوترة تفصل توكنات النص عن توكنات الصوت.
سجل التغييرات
28 يوليو 2026 — نُشرت الصفحة بعد مراجعة المصادر الرسمية وتسجيل الفجوات غير المنشورة.