OpenAI o3-mini 正式开放:小型推理模型首次支持函数调用与结构化输出
OpenAI 推理模型系列最新、最具成本效益的 o3-mini 正式对外开放,登陆 ChatGPT 与 API,首次支持函数调用、结构化输出,响应速度较 o1-mini 快 24%、成本降 63%。
OpenAI 于 2025 年 1 月 31 日宣布,推理模型系列最新、最具成本效益的 o3-mini 正式对外开放,同步登陆 ChatGPT 与 API。这是继 2024 年 12 月 20 日预告 o3/o3-mini 之后,首款进入正式生产环境的 o3 系列模型。官方表示,o3-mini 在科学、数学、编程等 STEM 领域表现出色,同时维持前代 o1-mini 原有的低成本与低延迟优势,让企业与开发者能以更低门槛导入推理能力。
ChatGPT Plus、Team、Pro 用户当天即可直接使用 o3-mini,免费用户也能在消息输入框选择「Reason」模式试用;Enterprise 版将于 2 月跟进开放。API 端同步提供,开发者可立即集成进现有应用程序。
技术意义:小模型首次补齐开发者刚需功能
本次发布最值得注意的,是 o3-mini 成为 OpenAI 首款支持函数调用(function calling)、结构化输出(Structured Outputs)与开发者消息(developer messages)的小型推理模型。此前 o1 系列推理模型虽然逻辑能力强,却缺乏这些工程团队在正式产品中高度依赖的功能,导致推理模型多半停留在「实验性使用」,难以直接嵌入生产流程。o3-mini 补齐这块拼图后,相当于把「会推理」与「能被程序稳定调用、输出可被系统解析」两件事第一次结合在一颗小模型上。
与前代比较:速度快 24%、成本降 63%
官方公布的数据显示,o3-mini 响应速度比 o1-mini 快 24%,每输入 token 成本则降低 63%。这意味着在同类 STEM 任务(如代码调试、数学运算、数据结构设计)上,企业能以更低成本、更短等待时间获得推理级别的输出质量,对需要大量调用模型的自动化流程或客服系统而言,这是直接反映在账单与使用体验上的改善。
业界反应:推理模型加速走向「可用于生产」
o3-mini 的发布延续了 2024 年底以来业界对「小型高效推理模型」的竞速——从 Google Gemini 2.0 Flash、Anthropic Claude 3.5 Haiku 到 Meta Llama 3.3,各家都在追求「用更小的模型做更贵模型才能做的事」。OpenAI 这次选择优先补上函数调用与结构化输出,被视为对开发者社区长期反馈的直接回应,也显示推理模型的竞争焦点已从单纯「解题能力」转向「能否被工程团队放心接入正式产品」。
对管理者的意义
这则新闻提醒管理者:评估 AI 落地时,除了看模型「聪不聪明」,更要看它能否稳定嵌入现有系统与流程——函数调用与结构化输出正是决定 AI 能否从「聊天室里的助理」变成「后台自动运行的员工」的关键能力,而成本大幅下降则让中小型组织也有机会把这类自动化规模化推广。