Google 發布 Gemini 3.7 Flash:主打程式開發與代理任務,年底前半價
Google 於 2026-08-13 正式發布 Gemini 3.7 Flash(GA),距前代僅三週。輸入上限 100 萬 token、支援工具呼叫與操作電腦,開發者當天即可於 API 端調用;即日起至年底輸入每百萬 token 僅 0.75 美元,2027 年起翻倍。Flash 線三週一迭代,旗艦 Gemini 3.5 Pro 卻仍未現身。
Google 於 2026 年 8 月 13 日正式發布 Gemini 3.7 Flash,API 代號為 gemini-3.7-flash。此次是正式版(GA)而非預覽,距離前代 Gemini 3.6 Flash 僅約三週。官方將其定位為「迄今最聰明的主力(workhorse)模型」,主攻程式開發與代理(agent)任務,並宣稱在軟體工程、知識工作、網頁開發三類工作流上都有明顯提升。
規格、價格與上架管道
規格面的重點如下:
- 輸入上限約 100 萬 token,輸出上限 6.4 萬 token。
- 多模態輸入:文字、圖片、影片、音訊、PDF 皆可直接餵入。
- 支援工具呼叫(tool calling)與操作電腦(computer use),可串接外部系統與自動化流程。
定價採導入期優惠:即日起至 2026 年 12 月 31 日,每百萬輸入 token 為 0.75 美元、每百萬輸出 token 為 3.75 美元;2027 年 1 月 1 日起回歸標準價,直接翻倍為輸入 1.50 美元、輸出 7.50 美元。換句話說,年底前的用量成本只有明年的一半。
上架管道分三層:開發者端當天即可透過 Gemini API、Google AI Studio、Android Studio 與 Google Antigravity 直接調用,不需受邀;企業端走 Gemini Enterprise Agent Platform;一般使用者則透過 Gemini App 的 Spark 模式分批開放,需 AI Pro 或 Ultra 訂閱,涵蓋 160 餘國。同日 GitHub Copilot 也宣布上架 Gemini 3.7 Flash。
廠商自報基準:三週一代的跳幅
以下數據皆為 Google 自行揭露,撰稿時尚無第三方複現,判讀時務必打折:
- FrontierCode 1.1:43.6%(3.6 Flash 為 34.4%)。
- DeepSWE v1.1:65.3%(3.6 Flash 為 49.0%)。
- WebDev Arena Elo:1588(3.6 Flash 為 1538,為 Elo 分數非百分比)。
若數字屬實,三週之內在程式與代理類任務上拉開約九到十六個百分點,代表中階模型的迭代節奏已快到讓「選型」本身變成一種持續作業,而非一次性決策。
Flash 線狂奔,Pro 線延宕
多家媒體同步點出的反差是:Google 的 Flash(中階快速)產品線維持約三週一次的高速迭代,但旗艦 Gemini 3.5 Pro 自 2026 年 5 月 19 日 Google I/O 宣告「六月 GA」以來,至今仍未發布,Pro 級最新版本仍是 2026 年 2 月 19 日的 Gemini 3.1 Pro Preview。Bloomberg 當日以「Google 發表新 Flash 模型、旗艦仍未到位」為題(大意)報導此事。
另一個對比在「可用性」:同日 OpenAI 發布 Ultrafast 模式(GPT-5.6 Sol 提速 14 倍),但僅開放受邀客戶的 limited preview;Gemini 3.7 Flash 則是開發者當天即可透過 Gemini API 與 AI Studio 直接調用、不需受邀(消費端仍是訂閱制、分批開放)。誰先做出來與誰先讓人用得到,是兩件事。
對管理者的意義
當中階模型三週一代、價格又在特定期間腰斬,資訊與數位團隊的評估週期若還是半年一次,等於永遠在用過期的成本假設做預算。年底前的優惠價與明年的標準價相差一倍,導入試算若沒有把 2027 年 1 月的漲幅算進去,很容易在專案第二年被成本追上。此外,「旗艦延宕、中階狂奔」也提醒管理者:別把導入計畫綁在尚未發布的旗艦承諾上,先用當下真的能調用的版本把流程跑起來,才是可控的作法。