OpenAI 今天給 ChatGPT 桌面應用動了一刀大升級——這個已經和 Codex 合體的客戶端,正式引入了由 GPT-Live 模型驅動的 ChatGPT Voice 語音模式。新版裏,用戶可以在聊天(Chat)、辦公(Work)和編程(Codex)三個板塊裏,直接用語音發起、檢查或調整任務,把多線程工作協同這件事,從敲鍵盤挪到了動嘴皮。

這條線的由來並不短。OpenAI 在2024年首次給 ChatGPT 加上語音識別,隨後一路猛攻語音技術,直到最新發佈的 GPT-Live 模型,才真正把全雙工能力跑通——它能一邊聆聽、一邊說話,讓 AI 對話的體感更貼近真人。OpenAI 在聲明裏把願景說得很直白:未來用戶只需口述需求,ChatGPT 就能順着你的思路,快速推進多項任務。
新語音模式最關鍵的本事,是支持用戶從單一對話裏啓動多個工作流程,並且在智能體後臺默默把任務跑完的同時,你還能繼續跟它聊。OpenAI 拿規劃一次商務旅行舉了例:你可以讓 ChatGPT 去翻日曆查衝突、掃收件箱看航班有沒有變、順手把會議記錄準備好——而這一切,都發生在"你衝咖啡或者幹別的"的工夫裏。比起單純把語音當輸入框,這種"你說話、它辦事、彼此不耽誤"的交互,正是 GPT-Live 想拉開差距的地方。
