OpenAI發佈公告,宣佈升級ChatGPT桌面應用(已與Codex合體),引入由GPT-Live模型驅動的ChatGPT Voice語音模式。用戶可在聊天、辦公和編程三個板塊中,通過語音發起、檢查或調整任務,實現多線程工作協同。

全雙工語音加持,邊聊邊幹活

在發展歷程上,OpenAI於 2024 年首次爲ChatGPT引入語音識別功能,隨後持續加碼語音技術。最新發佈的GPT-Live模型實現了全雙工語音,可同時聆聽與說話,讓AI對話感覺更接近真人交流。OpenAI在聲明中表示:"我們正朝着AI願景前行,未來用戶只需口述需求,ChatGPT就能根據你的思路快速推進多項任務。"

ChatGPT Voice支持用戶從單一對話中啓動多個工作流程,並在智能體後臺完成任務時繼續交談。以規劃一次商務旅行爲例,用戶可以要求ChatGPT檢查日曆查找衝突、梳理收件箱查看航班是否有變更,並準備會議記錄,所有這些都是在"用戶衝咖啡或做其他事情時"完成的。這意味着AI不再只是你問一句答一句的工具,而是能真正接管你的多任務工作流,讓語音交互從簡單的對話邁向高效的智能體協同。