OpenAI ने 8 जुलाई को GPT-Live-1 और GPT-Live-1 mini पेश किए और ChatGPT में वैश्विक विस्तार शुरू किया। मॉडल फुल डुप्लेक्स बातचीत संभालते हैं। यानी सिस्टम बोलते हुए सुन सकता है और हर संवाद को सख्त सवाल जवाब की बारी में बांधे बिना बीच में रोके जाने पर प्रतिक्रिया दे सकता है।
OpenAI के अनुसार आवाज सिस्टम बातचीत जारी रखते हुए खोज, रीजनिंग और अन्य जटिल काम GPT-5.5 को सौंप सकता है। इस बंटवारे में लाइव मॉडल समय और आवाज संभालता है, जबकि दूसरा मॉडल भारी काम करता है। काम सौंपते समय संदर्भ कितना बचता है, देरी कितनी स्पष्ट होती है और सिस्टम उपयोगकर्ता की बात पर बोलने से कैसे बचता है, ये संचालन के सवाल हैं, तय लॉन्च दावे नहीं।
API पहुंच बाद के लिए प्रस्तावित थी और पहले उपभोक्ता लॉन्च के साथ आम तौर पर उपलब्ध नहीं बताई गई। डेवलपरों को ChatGPT विस्तार और भविष्य की प्रोग्राम योग्य पहुंच अलग समझनी चाहिए। पात्र प्लान, समर्थित भाषाएं और क्षेत्रीय उपलब्धता बदल सकती हैं, इसलिए मौजूदा रिलीज नोट में पुष्टि जरूरी है।
31 जुलाई के अपडेट ने पात्र जनरेटेड ऑडियो के लिए SynthID सपोर्ट और सार्वजनिक व API सत्यापन के रास्ते जोड़े। यह शुरुआती लॉन्च के बाद आया, इसलिए इसे बाद का स्रोत पहचान अपडेट कहना चाहिए। इसे हर ऑडियो आउटपुट में पहले दिन से मौजूद सुविधा नहीं माना जा सकता।
मुख्य परीक्षा यह नहीं कि प्रदर्शन इंसान जैसा सुनाई देता है या नहीं। लगातार सुनने वाले असिस्टेंट को बीच में रोके जाने के बाद संभलना, सही समय पर चुप रहना, पीछे की आवाजों को संभालना और अर्थ खोए बिना अनुवाद करना होगा। TechCrunch ने एक प्रदर्शन में अस्वाभाविक हिंदी का उल्लेख किया, लेकिन एक उदाहरण बहुभाषी मूल्यांकन नहीं है और व्यापक गुणवत्ता रैंकिंग का आधार नहीं बन सकता।
अब आगे क्या
OpenAI का API लॉन्च, प्लान सूची, समर्थित भाषाएं और बीच में रोकने व अनुवाद के बाहरी परीक्षण बताएंगे कि नया वॉयस सिस्टम कितने व्यापक रूप से काम करता है।
स्रोत
यह पुनरावलोकन 3 अगस्त 2026 को OpenAI की घोषणा और रिलीज नोट, साथ ही लॉन्च संदर्भ के लिए TechCrunch रिपोर्ट के आधार पर तैयार किया गया। AI News of Today ने आवाज या भाषा परीक्षण नहीं किया।
जहां संभव हो, हम मूल दस्तावेज़ों और प्रत्यक्ष रिपोर्टिंग के लिंक देते हैं।