OpenAI 推出 Structured Outputs,同步大砍 GPT-4o 價格
OpenAI 發表 Structured Outputs API,保證模型輸出百分之百符合開發者指定的 JSON Schema;同時推出新版 gpt-4o-2024-08-06,輸入價格降五成、輸出價格降三成,最大輸出上限也大幅提升。
2024年8月6日,OpenAI 發表新功能「Structured Outputs」,保證模型輸出的 JSON 100% 符合開發者事先定義的 Schema。這項功能適用於所有支援 function calling 的模型,包括 gpt-4o、gpt-4o-mini。過去呼叫 API 要求結構化資料時,仍可能出現欄位缺漏、型別錯誤,開發者得自行寫程式二次驗證;官方表示新機制大幅提升輸出符合率,把「格式保證」直接內建在推論層。
同日,OpenAI 也推出新版模型 gpt-4o-2024-08-06,並大幅調降定價:輸入 token 降 50%、輸出 token 降 33%,換算每百萬輸入 2.5 美元、輸出 10 美元;單次最大輸出上限也從 4,096 一口氣提升到 16,384 token,官方強調基準測試表現維持不變。
技術意義:從「盡量聽話」到「保證聽話」
過去要讓模型穩定輸出結構化資料,業界慣用「提示工程+事後驗證+失敗重試」,本質上是賭模型會不會照格式走。Structured Outputs 把保證從應用層搬進推論層,開發者定義好 Schema,模型生成階段就被限制在合法路徑上,讓「格式錯誤」從機率問題變成確定性問題,減輕串接後端系統時的容錯負擔。
比較與業界反應
此次降價延續 5 月 GPT-4o 上市時把成本壓到 GPT-4 Turbo 一半的策略,這次再壓低輸出入價格並解除輸出長度瓶頸,同時處理開發者長期抱怨的「貴」與「輸出太短」。開發者社群普遍關注它與既有 JSON mode 的差異:JSON mode 只保證輸出是合法 JSON,不保證符合特定 Schema;Structured Outputs 兩者都保證,讓原本需另接 Pydantic、Zod 二次檢查的流程有機會簡化,從實驗性技巧變成生產環境可用的標準能力。
對管理者的意義
這次更新降低的不只是 API 帳單,更是「AI 輸出不穩定」帶來的工程與驗證成本——原本要多投入人力寫防呆邏輯的專案,現在可能用更少資源上線,值得列入評估 AI 專案投入報酬率的考量。