谷歌发布 Gemini 3.7 Flash:主打编程与智能体任务,年底前半价
谷歌于 2026-08-13 正式发布 Gemini 3.7 Flash(GA),距上一代仅三周。输入上限 100 万 token、支持工具调用与操作电脑,开发者当天即可在 API 端调用;即日起至年底输入每百万 token 仅 0.75 美元,2027 年起翻倍。Flash 线三周一迭代,旗舰 Gemini 3.5 Pro 却仍未现身。
谷歌于 2026 年 8 月 13 日正式发布 Gemini 3.7 Flash,API 代号为 gemini-3.7-flash。此次是正式版(GA)而非预览,距上一代 Gemini 3.6 Flash 仅约三周。官方将其定位为「迄今最聪明的主力(workhorse)模型」,主攻编程开发与智能体(agent)任务,并称在软件工程、知识工作、网页开发三类工作流上都有明显提升。
规格、价格与上线渠道
规格方面的重点如下:
- 输入上限约 100 万 token,输出上限 6.4 万 token。
- 多模态输入:文本、图片、视频、音频、PDF 均可直接输入。
- 支持工具调用(tool calling)与操作电脑(computer use),可对接外部系统与自动化流程。
定价采用导入期优惠:即日起至 2026 年 12 月 31 日,每百万输入 token 为 0.75 美元、每百万输出 token 为 3.75 美元;2027 年 1 月 1 日起回归标准价,直接翻倍为输入 1.50 美元、输出 7.50 美元。换言之,年底前的用量成本只有明年的一半。
上线渠道分三层:开发者当天即可通过 Gemini API、Google AI Studio、Android Studio 与 Google Antigravity 直接调用,无需受邀;企业端走 Gemini Enterprise Agent Platform;普通用户则通过 Gemini App 的 Spark 模式分批开放,需 AI Pro 或 Ultra 订阅,覆盖 160 余个国家和地区。同日 GitHub Copilot 也宣布上线 Gemini 3.7 Flash。
厂商自报基准:三周一代的跳幅
以下数据均为谷歌自行披露,截至发稿尚无第三方复现,解读时务必打折:
- FrontierCode 1.1:43.6%(3.6 Flash 为 34.4%)。
- DeepSWE v1.1:65.3%(3.6 Flash 为 49.0%)。
- WebDev Arena Elo:1588(3.6 Flash 为 1538,为 Elo 分数而非百分比)。
若数字属实,三周之内在编程与智能体类任务上拉开约九到十六个百分点,说明中端模型的迭代节奏已快到让「选型」本身变成持续作业,而非一次性决策。
Flash 线狂奔,Pro 线延宕
多家媒体同步指出的反差是:谷歌的 Flash(中端快速)产品线维持约三周一次的高速迭代,但旗舰 Gemini 3.5 Pro 自 2026 年 5 月 19 日谷歌 I/O 宣告「六月 GA」以来,至今仍未发布,Pro 级最新版本仍是 2026 年 2 月 19 日的 Gemini 3.1 Pro Preview。彭博当日以「谷歌发布新 Flash 模型、旗舰仍未到位」为题(大意)报道此事。
另一个对比在「可用性」:同日 OpenAI 发布 Ultrafast 模式(GPT-5.6 Sol 提速 14 倍),但仅开放受邀客户的 limited preview;Gemini 3.7 Flash 则是开发者当天即可通过 Gemini API 与 AI Studio 直接调用、无需受邀(消费端仍是订阅制、分批开放)。谁先做出来与谁先让人用得上,是两回事。
对管理者的意义
当中端模型三周一代、价格又在特定期间腰斩,信息与数字化团队的评估周期若还是半年一次,等于永远在用过期的成本假设做预算。年底前的优惠价与明年的标准价相差一倍,导入测算若没把 2027 年 1 月的涨幅算进去,很容易在项目第二年被成本追上。此外,「旗舰延宕、中端狂奔」也提醒管理者:别把导入计划绑在尚未发布的旗舰承诺上,先用当下真能调用的版本把流程跑起来,才是可控的做法。