专栏 AI 管理编年史 第 209/217 讲 查看课程目录

Google DeepMind 三箭齐发:Gemini 3.6 Flash 首发即 GA,工程任务成本最高省 65%

21/07/2026 103
3:23
Google DeepMind 三箭齐发:Gemini 3.6 Flash 首发即 GA,工程任务成本最高省 65%

2026年7月21日 Google DeepMind 同日发布三款模型:首发即 GA 的生产级主力 Gemini 3.6 Flash(DeepSWE 49%、OSWorld 83%、定价 $1.50/$7.50 per M tokens)、最低成本级 3.5 Flash-Lite、网络安全特化 3.5 Flash Cyber,并宣布 Gemini 4 最大规模预训练启动。

2026年7月21日,Google DeepMind 一口气发布三款模型:主角是首发即为 GA(生产级)的 Gemini 3.6 Flash,同场加映最低成本级的 Gemini 3.5 Flash-Lite,以及网络安全特化的 Gemini 3.5 Flash Cyber。

  • Gemini 3.6 Flash:GA 生产级主力,软件工程基准 DeepSWE 达 49%(前代为 37%)、电脑操作基准 OSWorld 达 83%,长程工程任务 token 成本最高可省 65%,定价每百万 token 输入 1.50 美元、输出 7.50 美元。
  • Gemini 3.5 Flash-Lite:定位最低成本级,服务大批量、简单、对延迟敏感的场景。
  • Gemini 3.5 Flash Cyber:专攻安全漏洞修补,目前仅向政府与信任伙伴开放试点。

DeepMind 同时宣布两件事:Gemini 4 已启动该公司史上最大规模预训练;而 5 月 I/O 发表后迟迟未正式开放的 Gemini 3.5 Pro,原定 7 月 17 日推出,如今再度延期。

技术意义:Flash 从「便宜版」变成主力

过去 Flash 系列被视为 Pro 的省钱替代品,这次 3.6 Flash 首发就以 GA 身份扛起生产主力:DeepSWE 从前代 37% 跳到 49%,代表它能处理近半数真实软件工程任务;83% 的 OSWorld 显示它操作电脑完成长流程的能力已达可用水准。搭配最高 65% 的 token 成本下降,Google 的信号很清楚——中型模型加效率优化,比一味堆大模型更符合企业落地需求。

三款分层+Gemini 4 的节奏信号

同日推出主力、最低成本、安全特化三个版本,是明确的「产品线分层」打法,对标 OpenAI 与 Anthropic 的多阶梯定价。Cyber 版只对政府与信任伙伴开放,显示漏洞自动修补这类双刃剑能力,厂商选择先圈起来管控。而 3.5 Pro 自 I/O 亮相以来一再跳票、资源转向 Gemini 4 最大规模预训练,透露 Google 把赌注押在下一代旗舰。

对管理者的意义

模型市场正走向「按工作分层买」:日常大批量任务用 Flash 级、简单任务用 Lite 级即可,成本可能只剩过去的几分之一。管理者评估 AI 供应商时,别再只问「最强的模型多强」,而要问「我的每一类工作,用哪一层最划算」。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 OpenAI 发布 Presence 企业级 AI 代理平台——自家客服线实测无人工解决 75% 来电

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策