专栏 AI 管理编年史 第 197/217 讲 查看课程目录

Gemini Omni Flash开发者预览上线 Google AI Studio与API开放、10秒视频生成上限

30/06/2026 261
2:37
Gemini Omni Flash开发者预览上线 Google AI Studio与API开放、10秒视频生成上限

Google DeepMind于2026年6月30日开放Gemini Omni Flash开发者公开预览,通过Google AI Studio与Gemini API即可调用,目前单次视频生成上限为10秒,主打多模态统一输出与低延迟。

Google DeepMind于2026年6月30日宣布,多模态模型「Gemini Omni Flash」进入开发者公开预览,开放通过Google AI Studio与Gemini API调用。官方将文字、图片、音频、视频的生成能力整合进单一模型端点,开发者无需再按输出类型分别调用不同模型。本次预览同时标注,视频生成功能设有10秒的单次上限,属公开测试阶段的安全阀,用意在于控管运算成本与内容审核风险,并非模型技术的天花板。Omni Flash延续「Flash」系列定位:以较低的生成质量换取更低延迟与调用成本,锁定聊天机器人动态贴图、社媒短视频测试稿、电商商品展示片段等大量、实时、低成本的应用场景。

技术意义与竞品比较

过去要让AI同时生成文案、示意图与短片,开发者常需串接多套模型分头处理,格式与风格不易对齐。Omni Flash把三种输出收拢进同一推理流程,呼应近一年行业从「多模型拼接」走向「单一模型多输出」的架构趋势。相较部分竞品已开放数十秒甚至分钟级的视频生成,Omni Flash预览阶段10秒的上限明显保守,反映Google DeepMind采取「先开放调用、再逐步放宽时长」的分阶段策略,优先观察调用模式与内容审核压力,而非一次冲规格数字。

行业反应

开发者社区讨论焦点集中在调用成本、速率限制与商用授权条款,多数反映10秒虽不利完整叙事型短片,但用于「快速生成草稿、再交由人工延展」的工作流程已足够实用。对管理者而言,真正值得留意的是「单一调用、多模态输出」的方向本身——未来内容草案的制作门槛可能进一步降低,值得让内部团队趁预览阶段申请试用、评估实际效益。

适用产业: 社群经营 直播带货
测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 Claude Code与Claude Cowork进驻Claude for Government Desktop公开测试版

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策