Gemini Omni Flash开发者预览上线 Google AI Studio与API开放、10秒视频生成上限
Google DeepMind于2026年6月30日开放Gemini Omni Flash开发者公开预览,通过Google AI Studio与Gemini API即可调用,目前单次视频生成上限为10秒,主打多模态统一输出与低延迟。
Google DeepMind于2026年6月30日宣布,多模态模型「Gemini Omni Flash」进入开发者公开预览,开放通过Google AI Studio与Gemini API调用。官方将文字、图片、音频、视频的生成能力整合进单一模型端点,开发者无需再按输出类型分别调用不同模型。本次预览同时标注,视频生成功能设有10秒的单次上限,属公开测试阶段的安全阀,用意在于控管运算成本与内容审核风险,并非模型技术的天花板。Omni Flash延续「Flash」系列定位:以较低的生成质量换取更低延迟与调用成本,锁定聊天机器人动态贴图、社媒短视频测试稿、电商商品展示片段等大量、实时、低成本的应用场景。
技术意义与竞品比较
过去要让AI同时生成文案、示意图与短片,开发者常需串接多套模型分头处理,格式与风格不易对齐。Omni Flash把三种输出收拢进同一推理流程,呼应近一年行业从「多模型拼接」走向「单一模型多输出」的架构趋势。相较部分竞品已开放数十秒甚至分钟级的视频生成,Omni Flash预览阶段10秒的上限明显保守,反映Google DeepMind采取「先开放调用、再逐步放宽时长」的分阶段策略,优先观察调用模式与内容审核压力,而非一次冲规格数字。
行业反应
开发者社区讨论焦点集中在调用成本、速率限制与商用授权条款,多数反映10秒虽不利完整叙事型短片,但用于「快速生成草稿、再交由人工延展」的工作流程已足够实用。对管理者而言,真正值得留意的是「单一调用、多模态输出」的方向本身——未来内容草案的制作门槛可能进一步降低,值得让内部团队趁预览阶段申请试用、评估实际效益。