專欄 AI 管理編年史 第 186/217 講 查看課程目錄

Google I/O 2026:正式推出 Gemini 3.5 與 Gemini Omni,影片生成邁入「任意輸入」新階段

19/05/2026 259
4:41
Google I/O 2026:正式推出 Gemini 3.5 與 Gemini Omni,影片生成邁入「任意輸入」新階段

Google 在 I/O 2026 開發者大會上宣布進入「代理型 Gemini 時代」,同步發表 Gemini 3.5(強化代理與程式撰寫能力)與 Gemini Omni(可將圖片、文字、影片、音訊等任意素材轉換為單一影片輸出)。

Google 於 2026 年 5 月 19 日的 I/O 開發者大會上,由執行長 Sundar Pichai 主題演講宣布正式進入「代理型 Gemini 時代」,同步推出兩項核心更新:主打前沿智慧與代理任務、程式撰寫能力的「Gemini 3.5」,以及全新生成模型「Gemini Omni」。Gemini Omni 結合 Gemini 的推理能力與 Google 生成式媒體技術,能將圖片、文字、既有影片片段、音訊等任意參考素材,整合轉換為單一連貫的影片輸出,並導入 Google 對物理世界的理解(重力、動能、流體力學等),讓生成畫面更符合真實物理邏輯。

效能數字說話:Gemini 3.5 Flash 逼近甚至超車前代旗艦

Google 公布的基準測試顯示,輕量版模型「Gemini 3.5 Flash」在多項指標上超越前一代旗艦「Gemini 3.1 Pro」:Terminal-Bench 2.1 達 76.2%(對比 3.1 Pro 的 70.3%)、MCP Atlas 達 83.6%(對比 78.2%)、Finance Agent v2 達 57.9%(對比 43.0%)、GDPval-AA 達 1656 Elo(對比 1314),多模態理解測試 CharXiv Reasoning 更達 84.2%。Google 並宣稱其輸出速度較其他前沿模型快上四倍。Gemini 3.5 Flash 已於發布當日同步全面上線 Gemini API、Google AI Studio、Google Antigravity、Vertex AI、Gemini App 與 Google 搜尋的 AI 模式。

Gemini Omni:從「文字轉影片」到「任意素材轉影片」

過去一年市面上的影片生成工具多以文字提示詞為主要輸入方式,Gemini Omni 的突破在於能同時理解圖片、文字、既有影片片段與音訊素材,將它們揉合成風格與內容連貫的新影片,並可用「電影運鏡」「更換背景」等簡單對話式指令進行編輯。目前「Gemini Omni Flash」版本已對 Google AI Plus、Pro、Ultra 訂閱用戶開放,可透過 Gemini App 與 Google Flow 使用;YouTube Shorts Remix 與 YouTube Create App(限 18 歲以上用戶)也可免費使用,開發者與企業客戶預計於未來數週內透過 Gemini API 與 Agent Platform API 陸續開放。所有生成影片均嵌入 Google 的 SynthID 數位浮水印,可在 Gemini App、Chrome 與搜尋中驗證來源。

業界解讀:Google 加碼影片生成與科研應用兩端

科技媒體普遍將 Gemini Omni 視為 Google 對 OpenAI 及其他影片生成模型近期動作的正面回應——目前多數對手仍侷限於單一模態輸入,Google 選擇以「任意輸入整合」與「物理真實感」作為差異化切入點。同場大會上,Google DeepMind 也宣布將互動世界生成工具 Project Genie 與近 20 年的 Google 街景影像資料串接,用於生成以真實地理為基礎的虛擬世界;另推出整合 AI Co-Scientist、AlphaEvolve 等系統的「Gemini for Science」科研工具套件。分析認為,Gemini 3.5 Flash 的全面上線對現有開發者影響更立即(關係到 API 呼叫成本與回應速度),Gemini Omni 則需要更長時間觀察實際生成品質、版權疑慮與商用穩定度。

對管理者的意義

對於需要製作商品介紹、教育訓練短片或社群行銷內容的管理者而言,Gemini Omni Flash 已可在多數員工日常使用的 Gemini App 與 Google Flow 中直接嘗試——不必等專業剪輯團隊,用手邊的商品照片和一段口頭說明就可能生成初版影片素材,並自帶浮水印利於內容溯源。建議先確認企業訂閱方案的授權範圍與素材版權疑慮,再評估是否納入常態內容產製流程。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 Anthropic 發表 Claude Opus 4.8:誠實可靠性升級,程式碼瑕疵疏漏率降約四分之三

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策