قدمت OpenAI نموذجي GPT-Live-1 وGPT-Live-1 mini في 8 يوليو، وبدأت طرحهما عالميا في ChatGPT. ويدعمان التفاعل مزدوج الاتجاه بالكامل، ما يسمح للنظام بمواصلة الاستماع أثناء الكلام والاستجابة للمقاطعات من دون إجبار كل تبادل على تسلسل صارم من السؤال والجواب.
قالت OpenAI إن النظام الصوتي يستطيع تمرير البحث والاستدلال وغيرهما من الأعمال المعقدة إلى GPT-5.5 مع الحفاظ على المحادثة. يتيح هذا التقسيم للنموذج المباشر إدارة التوقيت والكلام بينما يتولى نموذج آخر مهمة أثقل. لكن مدى احتفاظ النقل بالسياق وتوضيحه للتأخير وتجنبه الكلام فوق المستخدم تظل أسئلة تشغيلية وليست حقائق حسمها الإطلاق.
كان الوصول عبر API مقررا لوقت لاحق، ولم يقدم على أنه متاح عموما مع الإصدار الأول للمستهلكين. لذلك على المطورين الفصل بين الطرح في ChatGPT وأي وصول برمجي مستقبلي. كما يمكن أن تتغير أهلية الخطط واللغات المدعومة والتوفر الإقليمي، وينبغي تأكيدها في ملاحظات الإصدار الحالية.
أضاف تحديث في 31 يوليو دعم SynthID للصوت المولد المؤهل، مع مسارات تحقق عامة وعبر API. جاءت الإضافة بعد الإطلاق الأول، ويجب وصفها بأنها تحديث لاحق لإثبات المنشأ، لا ميزة كانت حاضرة بالضرورة في كل مخرج صوتي منذ اليوم الأول.
الاختبار الأساسي ليس مدى بشرية صوت في عرض توضيحي. فالمساعد الذي يستمع باستمرار يحتاج إلى التعافي من المقاطعات، والصمت في الوقت المناسب، والتعامل مع الكلام الخلفي، والترجمة من دون فقدان المعنى. أشارت TechCrunch إلى لغة هندية غير طبيعية في أحد العروض، لكن مثالا واحدا ليس تقييما متعدد اللغات ولا يبرر ترتيبا واسعا للجودة.
ما الذي نترقبه
سيظهر إطلاق API ومصفوفة الخطط وقائمة اللغات المدعومة والاختبارات الخارجية للمقاطعة والترجمة مدى اتساع عمل النظام الصوتي الجديد.
المصادر
أعد هذا الملف الاستعادي عن الإطلاق في 3 أغسطس 2026 استنادا إلى إعلان OpenAI وملاحظات الإصدار، مع تقرير TechCrunch لسياق الإطلاق. لم تجر AI News of Today اختبارا للصوت أو اللغة.
نضع روابط للوثائق الأصلية والتقارير المباشرة كلما كان ذلك ممكنا.