OpenAI 近日發布新一代語音模型 GPT-Live 系列,為 ChatGPT 的語音對話功能帶來重大升級,對話體驗大幅接近真人交流。

GPT-Live 採用全雙工(full-duplex)雙向架構,能夠同時聆聽與說話,打破傳統語音 AI「說完才聽」的限制。對話過程中,GPT-Live 會自然使用「對」、「嗯」、「了解」等回應表達正在聆聽,在使用者思考時安靜等待;使用者可隨時插話、暫停或要求放慢語速。

此次更新 OpenAI 重新設計了 9 種各具特色的聲音,讓使用者根據喜好選擇。當對話涉及需要網路搜尋、深度推理或複雜問題時,GPT-Live 會在幕後自動轉交 GPT-5.5 等進階模型處理,完成後再帶回對話,無縫整合多模型能力。

重點

  • 全雙工架構:真正的雙向語音通話,不再需要等待 AI 說完才能開口
  • 自然對話行為:支援插話、停頓、語速調整等真實對話互動
  • 9 種聲線:全新重製,各具個性特色
  • 多模型整合:複雜任務自動路由至 GPT-5.5 處理,回答後無縫帶回對話

編輯按

GPT-Live 是語音 AI 從「問答機器」邁向「真實對話夥伴」的重要一步。全雙工架構解決了過去語音模型最明顯的交互僵硬感,配合多模型後端的智慧路由,顯示 OpenAI 在語音界面的佈局已趨成熟。

本文由 AI 整理,原文:TechNews 科技新報