OpenAI o3-mini 正式開放:小型推理模型首度支援函式呼叫與結構化輸出
OpenAI 推理模型系列最新、最具成本效益的 o3-mini 正式對外開放,登陸 ChatGPT 與 API,首度支援函式呼叫、結構化輸出,回應速度較 o1-mini 快 24%、成本降 63%。
OpenAI 於 2025 年 1 月 31 日宣布,推理模型系列最新、最具成本效益的 o3-mini 正式對外開放,同步登陸 ChatGPT 與 API。這是繼 2024 年 12 月 20 日預告 o3/o3-mini 之後,首款進入正式生產環境的 o3 系列模型。官方表示,o3-mini 在科學、數學、程式設計等 STEM 領域表現出色,同時維持前代 o1-mini 原有的低成本與低延遲優勢,讓企業與開發者能以更低門檻導入推理能力。
ChatGPT Plus、Team、Pro 用戶當天即可直接使用 o3-mini,免費用戶也能在訊息輸入框選擇「Reason」模式試用;Enterprise 版將於 2 月跟進開放。API 端則同步提供,開發者可立即整合進既有應用程式。
技術意義:小模型首度補齊開發者剛需功能
本次發布最值得注意的,是 o3-mini 成為 OpenAI 首款支援函式呼叫(function calling)、結構化輸出(Structured Outputs)與開發者訊息(developer messages)的小型推理模型。過去 o1 系列推理模型雖然邏輯能力強,卻缺乏這些工程團隊在正式產品中高度依賴的功能,導致推理模型多半停留在「實驗性使用」,難以直接嵌入生產流程。o3-mini 補齊這塊拼圖後,等於把「會推理」與「能被程式穩定呼叫、輸出可被系統解析」兩件事第一次結合在一顆小模型上。
與前代比較:速度快 24%、成本降 63%
官方公布的數據顯示,o3-mini 回應速度比 o1-mini 快 24%,每輸入 token 成本則降低 63%。這代表在同樣的 STEM 類任務(如程式除錯、數學運算、資料結構設計)上,企業能以更低成本、更短等待時間取得推理等級的輸出品質,對於需要大量呼叫模型的自動化流程或客服系統而言,這是直接反映在帳單與使用體驗上的改善。
業界反應:推理模型加速走向「可用於生產」
o3-mini 的發布延續了 2024 年底以來業界對「小型高效推理模型」的競速——從 Google Gemini 2.0 Flash、Anthropic Claude 3.5 Haiku 到 Meta Llama 3.3,各家都在追求「用更小的模型做更貴模型才能做的事」。OpenAI 這次選擇優先補上函式呼叫與結構化輸出,被視為對開發者社群長期反饋的直接回應,也顯示推理模型的競爭焦點已從單純「解題能力」轉向「能否被工程團隊放心接進正式產品」。
對管理者的意義
這則新聞提醒管理者:評估 AI 導入時,除了看模型「聰不聰明」,更要看它能否穩定嵌進既有系統與流程——函式呼叫與結構化輸出正是決定 AI 能否從「聊天室裡的助理」變成「後台自動跑的員工」的關鍵能力,而成本大幅下降則讓中小型組織也有機會把這類自動化規模化。
大家怎麼說 · 5 則留言