Google 发布 Gemini Omni 1.1 Flash:最长扩展 40 秒,支持首尾帧控制与 4K 输出

行业动态

Google 发布 Gemini Omni 1.1 Flash:最长扩展 40 秒,支持首尾帧控制与 4K 输出

栏目:行业动态

摘要

Google 于 8 月 27 日发布 Gemini Omni 1.1 Flash,新增最长 40 秒场景延展、首尾帧控制、360p 快速草稿、1080p/4K 输出和视频参考输入,进一步把生成式视频推进到更完整的专业制作工作流。

本文目录
Gemini Omni 1.1 Flash 官方发布主视觉

图片来源:Google 官方博客

Google在2026年8月27日正式发布 Gemini Omni 1.1 Flash。这是一款面向视频生成与编辑工作流的高性能多模态模型,重点不是单纯提高“生成一段视频”的质量,而是把场景延长、镜头衔接、低成本预览和高分辨率输出这些更接近实际制作流程的能力放到同一个模型里。Google将这次更新定位为面向开发者的 production-ready版本,并通过 Gemini API、Google AI Studio以及企业平台逐步开放。

从“生成片段”走向可连续编辑的视频工作流

Gemini Omni 1.1 Flash最明显的变化,是把视频生成进一步推向连续创作。新版本支持场景延长,模型可以参考最多10秒的前文视频上下文,再继续生成后续画面;视频可以按10秒为单位继续延展,累计最长可到40秒。相比只参考最后一小段画面的方式,这种更长的上下文有利于保持人物、环境和叙事方向的一致性。

这项能力对短片、广告、故事镜头和连续动作尤其重要。开发者不必每次都从一段新视频重新开始,而是可以在已有结果上继续推进,再通过多轮生成逐步拉长故事。

首尾帧控制,让镜头衔接更可控

Omni 1.1还加入了首帧与尾帧指定能力。开发者可以给出一个镜头的起始画面和目标结束画面,让模型生成中间的连续运动。这种方式适合做镜头环绕、推进、拉远、变焦以及循环动画,也能减少不同片段拼接时出现的突兀跳变。

对于视频生成模型来说,这类能力的意义在于“可导演性”。过去很多生成式视频工具擅长做单个漂亮片段,但用户很难精确规定一个镜头从哪里开始、最后停在哪里。首尾帧控制让工作流更接近传统分镜和后期制作,而不是只靠一次提示词碰运气。

360p草稿模式降低试错成本

为了让创作者更快迭代,Gemini Omni 1.1 Flash新增360p预览模式。Google表示,相比标准720p生成,360p的系统吞吐速度最高可快约60%,成本约为720p的三分之一。开发者可以先用低分辨率快速测试构图、镜头、动作和不同提示词版本,确认方向后再生成正式画面。

这种“先草稿、后成片”的方式更适合真实生产环境,因为创作者往往会连续尝试多个版本。如果每一次测试都直接使用高分辨率生成,等待时间和计算成本都会迅速增加。

支持1080p与4K输出,并可加入视频参考

在最终输出阶段,Omni 1.1支持生成或提升到1080p、4K分辨率,目标是直接进入更专业的视频制作流程。与此同时,模型现在还可以接受最长约3秒的视频作为参考输入,再结合文本、图像等多模态素材生成新场景,以尽量保留动作、角色或视觉语境。

Google公布的开发者文档显示,API中的模型标识为 `gemini-omni-1.1-flash`。它面向高速视频生成、编辑和镜头控制,可通过 Gemini API调用。此次更新还进入 Google Flow,Google AI Plus、Pro和 Ultra用户可以使用相关能力,场景延长功能也开始进入 Gemini应用。

已进入实际产品集成阶段

Gemini Omni Flash已经不只是 Google自己的实验功能。Google公布的信息显示,Adobe已将 Omni Flash集成到 Adobe Firefly,Figma Weave、Runway等创作平台也在使用或接入相关能力。这说明 Google正在把 Omni系列从模型演示推进到专业内容工具和开发者产品中。

从这次1.1更新可以看出,Google视频模型的竞争重点正在从“单次生成效果”转向完整制作流程:先低成本预览,再控制镜头衔接和场景延长,最后输出到1080p或4K。对开发者和创意工具厂商来说,这种工作流层面的能力,比单纯提升一段样片的视觉质量更容易进入真实产品。

© 2026 DGNEWLIVE 保留所有权利.