OpenAI در ۸ ژوئیه GPT-Live-1 وGPT-Live-1 mini را معرفی و عرضه جهانی در ChatGPT را آغاز کرد. مدل‌ها تعامل دوطرفه کامل دارند، یعنی سامانه هنگام حرف زدن به شنیدن ادامه می‌دهد و بدون تبدیل هر تبادل به پرسش و پاسخ سخت به قطع صحبت واکنش نشان می‌دهد.

OpenAI گفت سامانه صوتی می‌تواند جست‌وجو، استدلال و کار پیچیده را به GPT-5.5 واگذار کند و گفت‌وگو را نگه دارد. مدل زنده زمان‌بندی و گفتار را اداره می‌کند و مدل دیگر کار سنگین‌تر را انجام می‌دهد. حفظ زمینه در تحویل، اعلام تأخیر و حرف نزدن روی صدای کاربر هنوز پرسش عملی است، نه نتیجه قطعی عرضه.

دسترسی API برای بعد برنامه‌ریزی شده بود و همراه انتشار نخست مصرف‌کننده به‌عنوان دسترسی عمومی معرفی نشد. توسعه‌دهنده باید عرضه ChatGPT را از دسترسی برنامه‌پذیر آینده جدا کند. واجد شرایط بودن طرح، زبان‌های پشتیبانی‌شده و منطقه نیز تغییر می‌کنند و نیاز به تأیید در یادداشت انتشار جاری دارند.

به‌روزرسانی ۳۱ ژوئیه پشتیبانی SynthID را برای صدای تولیدشده واجد شرایط و مسیرهای بررسی عمومی وAPI افزود. این قابلیت پس از عرضه نخست آمد و باید به‌عنوان به‌روزرسانی بعدی منشأ توصیف شود، نه ویژگی حاضر در هر خروجی از روز اول.

آزمون اصلی انسانی به نظر رسیدن نمایش نیست. دستیاری که پیوسته می‌شنود باید از قطع صحبت بازیابی شود، به‌موقع ساکت بماند، گفتار پس‌زمینه را مدیریت و بدون از دست دادن معنا ترجمه کند. TechCrunch هندی غیرطبیعی را در یک نمایش گزارش کرد، اما یک نمونه ارزیابی چندزبانه یا پایه رتبه‌بندی کلی کیفیت نیست.

در ادامه چه چیزی مهم است

عرضه API، جدول طرح‌ها، زبان‌های پشتیبانی‌شده و آزمایش بیرونی قطع صحبت و ترجمه دامنه عملکرد سامانه صوتی را نشان می‌دهند.

منابع

این پرونده بازنگرانه عرضه در ۳ اوت ۲۰۲۶ از اعلام و یادداشت‌های انتشار OpenAI و گزارش TechCrunch برای زمینه تهیه شد. AI News of Today آزمایش صدا یا زبان انجام نداده است.

تا جای ممکن به اسناد اصلی و گزارش‌های دست اول پیوند می‌دهیم.

  1. OpenAI GPT-Live announcementمنبع اصلی · ۱۷ تیر ۱۴۰۵
  2. TechCrunch launch coverageگزارش رسانه‌ای · ۱۷ تیر ۱۴۰۵ ساعت ۱۷:۰۰ UTC
  3. ChatGPT release notesمنبع اصلی · ۹ مرداد ۱۴۰۵