專欄 AI 管理編年史 第 203/217 講 查看課程目錄

OpenAI 發表 GPT-Live 語音模型:全雙工架構取代 ChatGPT 語音模式

08/07/2026 120
3:19
OpenAI 發表 GPT-Live 語音模型:全雙工架構取代 ChatGPT 語音模式

OpenAI 於 2026 年 7 月 8 日發表新一代語音模型 GPT-Live-1 與輕量版 GPT-Live-1 mini,採全雙工架構,可同時聆聽與說話,將取代 ChatGPT 既有的語音模式。

OpenAI 於 2026 年 7 月 8 日發表全新語音模型家族「GPT-Live-1」,同時推出精簡版「GPT-Live-1 mini」,並宣布將以此取代 ChatGPT 現行的語音模式。這是語音技術路線上一次明確的架構轉向:GPT-Live-1 採用「全雙工」(full-duplex)設計,模型可以在說話的同時持續聆聽使用者輸入,不需要像過去那樣等一方講完、切斷麥克風後另一方才能開口。過去 ChatGPT 的語音互動本質上是接力式流程,即便進階語音模式仍以近似輪流對話(turn-based)運作,使用者插話、打斷、同時發聲時容易出現辨識延遲或卡頓。官方將 GPT-Live-1 定位為「既有語音模式的直接替代品」,而非並行的實驗性功能。

技術意義與同業比較

全雙工語音模型的難點,不在單純的語音辨識或合成技術本身,而在於模型必須即時處理「聆聽」與「表達」兩個資料流的並行競合——什麼時候該搶話、什麼時候該安靜等待、什麼時候使用者的插話只是口頭禪而非真正打斷。這類系統過去多見於學術研究或實驗性語音助理,GPT-Live-1 若真能正式取代 ChatGPT 語音模式,代表 OpenAI 認為其穩定度、延遲與成本已達大規模商用門檻。mini 版同步推出,延續「旗艦版+輕量版」佈局,讓能力下放到嵌入式裝置或高並發客服等延遲敏感場景。相較於既有語音模式在多人交錯發言時常見的卡頓與搶話失敗,此架構若運作良好,對話節奏將更接近真人通話,也把這項此前多見於語音新創的能力,一次帶進最大規模的消費級應用,對整體賽道形成競爭壓力。

業界關注焦點

從發表方式看,「取代」而非「新增選項」是這次公告的關鍵字,代表現有數億語音使用者的體驗會被直接切換而非自由選用。這種做法一方面加快新架構普及,另一方面也考驗全雙工系統在高噪音、多語言混雜、口音多樣等真實場景下的穩健度,是否出現誤判打斷、搶話錯位等新型態體驗問題,是後續觀察重點。

對管理者的意義

對於仰賴語音客服、電話訂位、門市語音查詢等場景的管理者而言,全雙工語音模型意味著 AI 客服有機會更接近「自然應答、可被隨時打斷追問」的互動品質,值得留意 OpenAI 或第三方是否釋出對應 API 或客服整合方案,作為評估升級既有語音客服系統的參考。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 OpenAI推出ChatGPT Work:GPT-5.6家族驅動AI代理把目標直接變成品

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策