OpenAI در ۸ ژوئیه GPT-Live-1 وGPT-Live-1 mini را معرفی و عرضه جهانی در ChatGPT را آغاز کرد. مدلها تعامل دوطرفه کامل دارند، یعنی سامانه هنگام حرف زدن به شنیدن ادامه میدهد و بدون تبدیل هر تبادل به پرسش و پاسخ سخت به قطع صحبت واکنش نشان میدهد.
OpenAI گفت سامانه صوتی میتواند جستوجو، استدلال و کار پیچیده را به GPT-5.5 واگذار کند و گفتوگو را نگه دارد. مدل زنده زمانبندی و گفتار را اداره میکند و مدل دیگر کار سنگینتر را انجام میدهد. حفظ زمینه در تحویل، اعلام تأخیر و حرف نزدن روی صدای کاربر هنوز پرسش عملی است، نه نتیجه قطعی عرضه.
دسترسی API برای بعد برنامهریزی شده بود و همراه انتشار نخست مصرفکننده بهعنوان دسترسی عمومی معرفی نشد. توسعهدهنده باید عرضه ChatGPT را از دسترسی برنامهپذیر آینده جدا کند. واجد شرایط بودن طرح، زبانهای پشتیبانیشده و منطقه نیز تغییر میکنند و نیاز به تأیید در یادداشت انتشار جاری دارند.
بهروزرسانی ۳۱ ژوئیه پشتیبانی SynthID را برای صدای تولیدشده واجد شرایط و مسیرهای بررسی عمومی وAPI افزود. این قابلیت پس از عرضه نخست آمد و باید بهعنوان بهروزرسانی بعدی منشأ توصیف شود، نه ویژگی حاضر در هر خروجی از روز اول.
آزمون اصلی انسانی به نظر رسیدن نمایش نیست. دستیاری که پیوسته میشنود باید از قطع صحبت بازیابی شود، بهموقع ساکت بماند، گفتار پسزمینه را مدیریت و بدون از دست دادن معنا ترجمه کند. TechCrunch هندی غیرطبیعی را در یک نمایش گزارش کرد، اما یک نمونه ارزیابی چندزبانه یا پایه رتبهبندی کلی کیفیت نیست.
در ادامه چه چیزی مهم است
عرضه API، جدول طرحها، زبانهای پشتیبانیشده و آزمایش بیرونی قطع صحبت و ترجمه دامنه عملکرد سامانه صوتی را نشان میدهند.
منابع
این پرونده بازنگرانه عرضه در ۳ اوت ۲۰۲۶ از اعلام و یادداشتهای انتشار OpenAI و گزارش TechCrunch برای زمینه تهیه شد. AI News of Today آزمایش صدا یا زبان انجام نداده است.
تا جای ممکن به اسناد اصلی و گزارشهای دست اول پیوند میدهیم.