OpenAI 推出 Structured Outputs,同步大砍 GPT-4o 价格
OpenAI 发布 Structured Outputs API,保证模型输出百分之百符合开发者指定的 JSON Schema;同时推出新版 gpt-4o-2024-08-06,输入价格降五成、输出价格降三成,最大输出上限也大幅提升。
2024年8月6日,OpenAI 发布新功能「Structured Outputs」,保证模型输出的 JSON 100% 符合开发者事先定义的 Schema。这项功能适用于所有支持 function calling 的模型,包括 gpt-4o、gpt-4o-mini。过去调用 API 要求结构化数据时,仍可能出现字段缺失、类型错误,开发者得自行编写代码做二次校验;官方表示新机制大幅提升输出符合率,把「格式保证」直接内置在推理层。
同日,OpenAI 也发布新版模型 gpt-4o-2024-08-06,并大幅下调定价:输入 token 降 50%、输出 token 降 33%,折合每百万输入 2.5 美元、输出 10 美元;单次最大输出上限也从 4,096 一口气提升到 16,384 token,官方强调基准测试表现保持不变。
技术意义:从「尽量听话」到「保证听话」
过去要让模型稳定输出结构化数据,业界惯用「提示工程+事后校验+失败重试」,本质上是赌模型会不会按格式走。Structured Outputs 把这道保证从应用层搬进推理层,开发者定义好 Schema,模型在生成阶段就被限制在合法路径上,让「格式错误」从概率问题变成确定性问题,减轻对接后端系统时的容错负担。
对比与业界反应
此次降价延续 5 月 GPT-4o 上市时把成本压到 GPT-4 Turbo 一半的策略,这次再压低输入输出价格并解除输出长度瓶颈,同时解决开发者长期抱怨的「贵」与「输出太短」。开发者社区普遍关注它与既有 JSON mode 的差异:JSON mode 只保证输出是合法 JSON,不保证符合特定 Schema;Structured Outputs 两者都保证,让原本需另接 Pydantic、Zod 二次检查的流程有机会简化,从实验性技巧变成生产环境可用的标准能力。
对管理者的意义
这次更新降低的不只是 API 账单,更是「AI 输出不稳定」带来的工程与校验成本——原本要多投入人力编写防错逻辑的项目,现在可能用更少资源上线,值得列入评估 AI 项目投入产出比的考量。