OpenAI推出GPT-4o mini,取代ChatGPT内置GPT-3.5 Turbo
OpenAI发布低成本小型模型GPT-4o mini,直接取代ChatGPT内置的GPT-3.5 Turbo,定价每百万输入token 15美分、输出60美分,大幅降低AI使用成本。
OpenAI于2024年7月18日发布GPT-4o mini,这是一款比旗舰模型GPT-4o更小、更快、更省成本的新一代小型模型。即日起,GPT-4o mini直接在ChatGPT网页版与移动App中取代原本内置的GPT-3.5 Turbo,免费与付费用户均可使用,开发者也能通过API调用;企业用户则将于一周后陆续获得访问权限。
官方定价为每百万输入token 15美分、每百万输出token 60美分,比之前最顶尖模型便宜超过一个数量级,也比旧有GPT-3.5 Turbo便宜逾六成。在推理、数学、代码编写等多项基准测试中,表现优于GPT-3.5 Turbo与其他同级小型模型。
规格定位与竞品对比
GPT-4o mini延续GPT-4o的多模态架构,支持文字与图像输入,未来将纳入视频与音频。它并非旗舰模型的缩水版,而是被定位为「日常任务的主力模型」——处理客服对话、内容分类、摘要生成、代码辅助等大量、对延迟与成本敏感的应用,显示OpenAI从单一旗舰模型转向「旗舰负责复杂推理、小模型负责规模化部署」的双轨策略。这一定价也直接对标Google此前推出的Gemini 1.5 Flash,显示大型模型厂商的竞争焦点,已从「谁的模型最强」扩大到「谁能用最低成本规模化部署AI」。
业界反应:降低导入AI的门槛
不少开发者与分析师认为,GPT-4o mini的意义不在模型能力突破,而在于让「大量、高频次调用AI」在财务上变得可行——过去因单次成本过高而搁置的自动化构想(如逐条审核客服消息、实时翻译大量文件),现在值得重新评估。也有声音提醒,价格战恐让中小型AI创业公司面临更大生存压力。
对管理者的意义
当一次AI调用的成本降到分毫之间,过去因「不划算」被否决的自动化提案值得重新算一笔账——尤其是客服应答、文件分类、社群留言筛选这类大量重复、规则清晰的工作。管理者不必等到「最强模型」才导入AI,反而应优先评估哪些日常流程体量大、单笔决策简单,适合用低成本小模型先跑起来、边做边调整。