OpenAI הציגה ב-8 ביולי את GPT-Live-1 ואת GPT-Live-1 mini והחלה בפריסה עולמית ב-ChatGPT. המודלים תומכים בתקשורת דו-כיוונית בו-זמנית, כך שהמערכת יכולה להמשיך להאזין בזמן שהיא מדברת ולהגיב להפרעות בלי לכפות על כל שיחה מבנה נוקשה של שאלה ותשובה.
OpenAI אומרת שמערכת הקול יכולה להעביר חיפוש, הסקה ועבודה מורכבת אחרת ל-GPT-5.5 בזמן שהשיחה נמשכת. החלוקה מאפשרת למודל החי לטפל בתזמון ובדיבור, בזמן שמודל אחר מבצע את העבודה הכבדה. שמירת ההקשר בהעברה, הצגת עיכובים והימנעות מדיבור מעל המשתמש נשארות שאלות תפעוליות ולא מסקנות שהוכרעו בהשקה.
הגישה דרך API תוכננה למועד מאוחר יותר ולא הוצגה כזמינה באופן כללי עם גרסת הצרכנים הראשונה. לכן מפתחים צריכים להפריד בין הפריסה ב-ChatGPT לבין גישה תכנותית עתידית. הזכאות לפי תוכנית, השפות הנתמכות והזמינות האזורית עשויות להשתנות ודורשות אימות בתיעוד השחרור העדכני.
עדכון מ-31 ביולי הוסיף תמיכת SynthID לאודיו שנוצר ועומד בתנאים, יחד עם מסלולי אימות ציבוריים וב-API. התוספת הגיעה לאחר ההשקה הראשונית ויש לתאר אותה כעדכון מקור מאוחר יותר, לא כתכונה שהייתה בהכרח בכל פלט אודיו מהיום הראשון.
המבחן החשוב אינו אם הדגמה נשמעת אנושית. עוזר שמאזין ברצף צריך להתאושש מהפרעה, לשתוק ברגע הנכון, להתמודד עם קולות רקע ולתרגם בלי לאבד משמעות. TechCrunch ציין הינדית לא טבעית בהדגמה אחת, אך דוגמה יחידה אינה הערכה רב-לשונית ואינה תומכת בדירוג איכות רחב.
מה צפוי בהמשך
השקת ה-API, מטריצת התוכניות, רשימת השפות ובדיקות חיצוניות של הפרעות ותרגום יראו עד כמה מערכת הקול החדשה פועלת בהיקף רחב.
מקורות
הכתבה הרטרוספקטיבית הזו הוכנה ב-3 באוגוסט 2026 על סמך ההכרזה ותיעוד השחרור של OpenAI, לצד דיווח TechCrunch להקשר. AI News of Today לא ערך בדיקת קול או שפה.
ככל שניתן, אנו מקשרים למסמכים מקוריים ומסתמכים על דיווח ממקור ראשון.