專欄 AI 管理編年史 第 209/217 講 查看課程目錄

Google DeepMind 三箭齊發:Gemini 3.6 Flash 首發即 GA,工程任務成本最高省 65%

21/07/2026 102
3:23
Google DeepMind 三箭齊發:Gemini 3.6 Flash 首發即 GA,工程任務成本最高省 65%

2026年7月21日 Google DeepMind 同日發布三款模型:首發即 GA 的生產級主力 Gemini 3.6 Flash(DeepSWE 49%、OSWorld 83%、定價 $1.50/$7.50 per M tokens)、最低成本級 3.5 Flash-Lite、資安特化 3.5 Flash Cyber,並宣布 Gemini 4 最大規模預訓練啟動。

2026年7月21日,Google DeepMind 一口氣發布三款模型:主角是首發即為 GA(生產級)的 Gemini 3.6 Flash,同場加映最低成本級的 Gemini 3.5 Flash-Lite,以及資安特化的 Gemini 3.5 Flash Cyber。

  • Gemini 3.6 Flash:GA 生產級主力,軟體工程基準 DeepSWE 達 49%(前代為 37%)、電腦操作基準 OSWorld 達 83%,長程工程任務 token 成本最高可省 65%,定價每百萬 token 輸入 1.50 美元、輸出 7.50 美元。
  • Gemini 3.5 Flash-Lite:定位最低成本級,服務大量、簡單、對延遲敏感的場景。
  • Gemini 3.5 Flash Cyber:專攻資安漏洞修補,目前僅開放政府與信任夥伴 pilot 試點。

DeepMind 同時宣布兩件事:Gemini 4 已啟動該公司史上最大規模預訓練;而 5 月 I/O 發表後遲未正式開放的 Gemini 3.5 Pro,原定 7 月 17 日推出,如今再度延期。

技術意義:Flash 從「便宜版」變成主力

過去 Flash 系列被視為 Pro 的省錢替代品,這次 3.6 Flash 首發就以 GA 身分扛起生產主力:DeepSWE 從前代 37% 跳到 49%,代表它能處理近半數真實軟體工程任務;83% 的 OSWorld 顯示它操作電腦完成長流程的能力已達可用水準。搭配最高 65% 的 token 成本下降,Google 的訊號很清楚——中型模型加效率優化,比一味堆大模型更符合企業落地需求。

三款分層+Gemini 4 的節奏訊號

同日推出主力、最低成本、資安特化三個版本,是明確的「產品線分層」打法,對標 OpenAI 與 Anthropic 的多階梯定價。Cyber 版只對政府與信任夥伴開放,顯示漏洞自動修補這類雙面刃能力,廠商選擇先圈起來管控。而 3.5 Pro 自 I/O 亮相以來一再跳票、資源轉向 Gemini 4 最大規模預訓練,透露 Google 把賭注押在下一代旗艦。

對管理者的意義

模型市場正走向「按工作分層買」:日常大量任務用 Flash 級、簡單任務用 Lite 級即可,成本可能只剩過去的幾分之一。管理者評估 AI 供應商時,別再只問「最強的模型多強」,而要問「我的每一類工作,用哪一層最划算」。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 OpenAI 發布 Presence 企業級 AI 代理平台——自家客服線實測無人工解決 75% 來電

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策