專欄 AI 管理編年史 第 253/303 講 查看課程目錄

Google 發布 Gemini Omni 1.1 Flash:影片生成新增場景延伸、首尾影格、360p 草稿與 4K 輸出

28/08/2026 110
3:53
Google 發布 Gemini Omni 1.1 Flash:影片生成新增場景延伸、首尾影格、360p 草稿與 4K 輸出
圖/Photo by Jakob Owens on Unsplash

Google DeepMind 於 2026 年 8 月 27 日發布影片生成模型 Gemini Omni 1.1 Flash:場景延伸改看前 10 秒脈絡、可指定首尾影格、新增 360p 草稿模式(相較 720p 最多快 60%、成本三分之一)與 1080p/4K 輸出,Gemini API 即日可用。本文解讀技術意義、價格分層策略與對管理者的啟示。

Google DeepMind 於 2026 年 8 月 27 日(美西時間)在 Google 官方部落格發布 Gemini Omni 1.1 Flash,由產品經理 Anish Nangia 與 Alisa Fortin 署名。這是 Google 影片生成與編輯多模態模型的新版本,即日起在 Gemini API(Google AI Studio)開放,同步進入 Gemini Enterprise Agent Platform;創作工具 Google Flow 對 AI Plus/Pro/Ultra 訂戶開放,Gemini App 的場景延伸功能則向全球 Plus/Pro/Ultra 訂戶推出。

五項新功能:從「單次生成」走向「可延續、可控制的製作」

  • 場景延伸:模型分析前 10 秒的脈絡(前代只看最後 1 秒),每次可延長 10 秒、最長 40 秒,並保持角色、光線與敘事一致。
  • 指定首尾影格:給出起始與結束畫面,模型自動生成中間的連續鏡頭與運鏡。
  • 360p 草稿模式:相較 720p 標準模式最多快 60%、成本只有三分之一,用來快速打樣。
  • 1080p/4K 高解析輸出:供專業製作與正式交付使用。
  • 影片參考:可上傳最多 3 秒的外部片段,作為角色或動態的風格參考。

定價以「每秒輸出」計算:360p 為 0.03 美元、720p 為 0.10 美元、1080p 為 0.15 美元、4K 為 0.30 美元。

技術意義:脈絡窗口從 1 秒拉到 10 秒

影片生成模型長期的痛點是「一延長就走樣」——角色換臉、光線跳動、動作接不上。前代僅以最後 1 秒作為延伸依據,模型其實不知道前面發生了什麼;1.1 Flash 把參考脈絡拉到 10 秒,等於讓模型記得完整的一個鏡頭段落,敘事才可能連貫。首尾影格則是把動畫業的「關鍵影格」工作法搬進生成模型:人決定起點與終點,機器負責補間。兩者加起來,生成影片開始具備「可導演性」,而不只是抽卡式的隨機輸出。

與競品比較:用價格分層打開「先草稿再精修」的節奏

360p 草稿模式是本次最務實的設計。多數影片生成工具沒有獨立的低解析度草稿價位,反覆修改提示詞往往以正式輸出的價格計費,試錯成本很快失控。Google 把草稿定在 720p 標準模式三分之一的價格、最多快六成,明確引導使用者「用 360p 反覆試、確定後再出 4K」,與軟體業「先原型再量產」的邏輯一致;以 4K 每秒 0.30 美元計,一支 30 秒短片約 9 美元。the-decoder、Neowin 等媒體於同日跟進報導;從 API 首發與定價透明的策略看,Google 顯然瞄準開發者市場,與 OpenAI Sora、快手可靈(Kling)、Runway 正面競爭。

對管理者的意義

對在泰國經營電商、零售或旅宿的管理者而言,這則新聞的重點不是「AI 又能做影片了」,而是製作流程的成本結構變了:行銷短片的試錯成本降到每秒幾美分,且能指定首尾畫面鎖住品牌調性。若團隊已有素材,可先用 360p 草稿測三到五個版本,內部拍板後再輸出 4K 上架,把外包剪輯來回的時間壓縮到一天之內。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 Anthropic 同日發表 Claude Fable 5.1 與 Mythos 5.1:快取讀取降價七成五,護欄改走「更精準」路線

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策