Google DeepMind 三箭齐发:Gemini 3.6 Flash 首发即 GA,工程任务成本最高省 65%
2026年7月21日 Google DeepMind 同日发布三款模型:首发即 GA 的生产级主力 Gemini 3.6 Flash(DeepSWE 49%、OSWorld 83%、定价 $1.50/$7.50 per M tokens)、最低成本级 3.5 Flash-Lite、网络安全特化 3.5 Flash Cyber,并宣布 Gemini 4 最大规模预训练启动。
2026年7月21日,Google DeepMind 一口气发布三款模型:主角是首发即为 GA(生产级)的 Gemini 3.6 Flash,同场加映最低成本级的 Gemini 3.5 Flash-Lite,以及网络安全特化的 Gemini 3.5 Flash Cyber。
- Gemini 3.6 Flash:GA 生产级主力,软件工程基准 DeepSWE 达 49%(前代为 37%)、电脑操作基准 OSWorld 达 83%,长程工程任务 token 成本最高可省 65%,定价每百万 token 输入 1.50 美元、输出 7.50 美元。
- Gemini 3.5 Flash-Lite:定位最低成本级,服务大批量、简单、对延迟敏感的场景。
- Gemini 3.5 Flash Cyber:专攻安全漏洞修补,目前仅向政府与信任伙伴开放试点。
DeepMind 同时宣布两件事:Gemini 4 已启动该公司史上最大规模预训练;而 5 月 I/O 发表后迟迟未正式开放的 Gemini 3.5 Pro,原定 7 月 17 日推出,如今再度延期。
技术意义:Flash 从「便宜版」变成主力
过去 Flash 系列被视为 Pro 的省钱替代品,这次 3.6 Flash 首发就以 GA 身份扛起生产主力:DeepSWE 从前代 37% 跳到 49%,代表它能处理近半数真实软件工程任务;83% 的 OSWorld 显示它操作电脑完成长流程的能力已达可用水准。搭配最高 65% 的 token 成本下降,Google 的信号很清楚——中型模型加效率优化,比一味堆大模型更符合企业落地需求。
三款分层+Gemini 4 的节奏信号
同日推出主力、最低成本、安全特化三个版本,是明确的「产品线分层」打法,对标 OpenAI 与 Anthropic 的多阶梯定价。Cyber 版只对政府与信任伙伴开放,显示漏洞自动修补这类双刃剑能力,厂商选择先圈起来管控。而 3.5 Pro 自 I/O 亮相以来一再跳票、资源转向 Gemini 4 最大规模预训练,透露 Google 把赌注押在下一代旗舰。
对管理者的意义
模型市场正走向「按工作分层买」:日常大批量任务用 Flash 级、简单任务用 Lite 级即可,成本可能只剩过去的几分之一。管理者评估 AI 供应商时,别再只问「最强的模型多强」,而要问「我的每一类工作,用哪一层最划算」。