專欄 AI 管理編年史 第 272/303 講 查看課程目錄

ChatGPT 語音接上前沿推理模型:GPT-6 Astra 可以用講的,三級語音智慧等級走入歷史

09/09/2026 227
4:30
ChatGPT 語音接上前沿推理模型:GPT-6 Astra 可以用講的,三級語音智慧等級走入歷史
圖/Photo by Yucel M on Unsplash

OpenAI 於 2026 年 9 月 9 日更新 ChatGPT 語音模式,語音對話在需要搜尋或深度推理時可直接調用 GPT-5.6 與 GPT-6 Astra,模型與推理強度改由用戶自選,原本的 Instant/Medium/High 三級語音智慧等級全面廢除,額度同步重新分層,Plus 與 Pro 用完後不再自動降級。

OpenAI 在 2026 年 9 月 9 日的 ChatGPT 更新說明中宣布,語音模式(ChatGPT Voice)正式接上前沿推理模型。往後使用者在語音對話中提出需要網路搜尋、或需要較深推理的問題時,系統可以直接調用 GPT-5.6 或 GPT-6 Astra 來作答,不再侷限於專為即時對話最佳化的輕量語音模型。這項變更同時出現在 help.openai.com 的 ChatGPT Release Notes(2026-09-09)與 releasebot.io 的 OpenAI 更新彙整中。

控制項統一:語音不再是獨立產品線

過去 ChatGPT 語音有一套獨立的「Voice intelligence level」,分成 Instant、Medium、High 三級,對使用者而言只能在這三個抽象檔位之間切換。這次更新把三級制度直接廢除,改為與文字對話共用同一組控制項:使用者自己選模型、自己選推理強度。這代表 OpenAI 把語音收斂成「同一個模型的另一種輸入輸出介面」——文字對話養成的操作習慣可以整套搬到語音,組織要導入時也不必為語音場景另外寫一份能力說明與教育訓練。從額度分層同時列出 GPT-Live-1 與 mini 可推知,一般對話仍由輕量語音模型即時處理,遇到需要查資料或多步推理的問題才交給前沿模型;語音助理長年「要快就得犧牲品質」的取捨,被改寫成背後的模型分流。

額度重新分層:用完不再被無聲降級,Think 下放免費層

隨著模型調整,語音額度也重新分層:

  • Go 方案:3 小時,使用 GPT-Live-1 mini
  • Plus 方案:3 小時,使用 GPT-Live-1
  • Pro $100 方案:15 小時
  • Pro $200 方案:無限使用

更關鍵的是配套規則:Plus 與 Pro 用戶在額度用罄後,不再被自動降級到 mini 模型。過去「無聲降級」最惱人的地方,在於品質下滑卻沒有明確提示,使用者常常講到一半才察覺回答變得敷衍;改成硬性額度後可預期性提高,代價則是用完就是用完。額度改以「小時」而非訊息數計算,推測與語音成本取決於通話時長有關。同一批更新中,OpenAI 也把 Think(延長思考)開放給 Free 與 Go 方案,網頁版使用者可手動選用;同期各家仍在推理能力的分層、速度與額度上限上持續競爭。

對管理者的意義

對經常不在座位上的管理者來說,這次更新把語音從「快速問答工具」升級為「可推理、可查資料的工作介面」:開車通勤時口述詢問一個合約條款的判斷、在工廠產線走動時問一個品質異常的可能原因、在門市巡店途中口述當天的處置決定——這些過去只能得到淺層回答的場景,現在有機會拿到接近文字對話品質的分析。

值得先想清楚的是兩件事:

  • 額度以小時計,習慣把 AI 當背景音的人會消耗得比想像中快,團隊導入前應先估算真實通話時數。
  • 語音輸入的內容多半是即時、口語、未經整理的,涉及員工個資、客戶名單或未公開財務數字時,仍須遵守與文字輸入相同的資料揭露規範,不會因為「只是講講」而降低風險。

語音接上前沿模型之後,真正的差別已經不在於能問什麼,而在於你願意把哪些內容說出口。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 OpenAI 開發者平台雙發:GPT-Live-1 語音進 API、Agents API 公開測試

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策