專欄 AI 管理編年史 第 128/217 講 查看課程目錄

Google發表Gemini 2.5 Flash與Flash-Lite更新版 效率大幅提升

25/09/2025 81
3:14
Google發表Gemini 2.5 Flash與Flash-Lite更新版 效率大幅提升

Google於2025年9月25日在Google AI Studio與Vertex AI推出Gemini 2.5 Flash與Flash-Lite更新版,Flash-Lite輸出token用量減少50%、Flash減少24%,代理式工具調用能力明顯提升。

Google於2025年9月25日在Google Developers Blog發表Gemini 2.5 Flash與Flash-Lite更新版,已在Google AI Studio與Vertex AI上提供。這次更新重點不是全新模型架構,而是「效率」:Flash-Lite輸出token用量減少50%,等同成本降低一半;Flash則減少24%。對長期依賴API呼叫量計費的企業與開發者來說,這是直接反映在帳單上的改變。除了省token,新版Flash在「代理式工具調用」(agentic tool use)能力上也有明顯進步:SWE-bench Verified分數由前代48.9%提升至54%,代表模型在需要連續呼叫外部工具、逐步解決複雜任務(如自動修復程式碼)時,準確率有實質提升。新版開啟「思考模式」(thinking mode)時,也能以更少token達到更高品質輸出,同時降低延遲與成本。

技術意義:省錢與變聰明同時發生

過去模型升級常見「更強但更貴」,這次更新則罕見地讓效率與能力同時提升,反映Flash系列定位越來越清楚:不是拚跑分的旗艦模型,而是主打「大量呼叫、即時回應」場景(如客服機器人、自動化流程、即時摘要)的工作馬模型,token成本下降對高頻使用情境影響尤其顯著。

與前代及定位的比較

官方說明這次釋出的是「預覽版」(可用字串gemini-2.5-flash-preview-09-2025測試),不會直接取代現有正式穩定版。Google把更新定位為「探路」——蒐集開發者實際使用回饋,再決定哪些改進正式納入下一個穩定版,顯示供應商推動更新時越來越謹慎,避免大改動造成既有應用行為不可預期的變化。

業界反應:持續的「降本增效」競賽

此次更新緊接同月稍早Gemini系列調整之後,顯示Google正加速更新頻率,而OpenAI、Anthropic、xAI等競爭對手近月也都推出強調成本效率或工具調用能力的模型版本。這場「同樣品質、更低成本」的競賽,正把AI從昂貴的實驗性技術,推向可大規模嵌入日常系統的基礎建設。

對管理者而言,這則新聞的意義不在於要不要換模型,而在於提醒:AI導入成本結構正持續下降,過去因token成本卡關、暫緩上線的自動化流程(如客服應答、庫存查詢代理、報表摘要),現在值得重新評估可行性。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 Anthropic 發表 Claude Sonnet 4.5:SWE-bench 77.2% 創新高,官方稱「全球最強程式模型」

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策