Google Flow 在 2026 年 8 月推出 Gemini Omni 1.1 Flash 更新,引入起始帧/结束帧控制、对话式细化编辑以及 1080p 与 4K 导出,旨在把生成式视频从快速生成转向更可控的剪辑与高分辨率交付流程。更新强调工作流化的创作与后期交付能力,但功能可用性受模型、订阅与地区限制影响。
2026年8月27日,Google Flow推出新一轮视频创作更新。谷歌表示,平台开始通过 Gemini Omni 1.1 Flash 提供更多剪辑控制,包括设置视频的起始帧和结束帧,以及将成片导出为 1080p 或 4K 分辨率。对使用生成式工具制作广告、短片和社交内容的创作者来说,这次更新的重点不只是“生成得更快”,而是让素材更容易保持连续性,并更接近可以交付的制作流程。
这次更新改变了什么
根据谷歌发布的更新说明,Gemini Omni 1.1 Flash在 Google Flow 中增加了几项面向后期制作的能力:
| 更新 | 作用 |
|---|---|
| 起始帧与结束帧 | 让创作者指定片段的前后状态,由模型生成中间过渡,帮助维持角色和叙事连续性 |
| 更精细的视频编辑 | 在已有素材基础上继续修改,而不是每次从零生成 |
| 1080p与4K导出 | 为较高质量的发布和后续剪辑提供更高分辨率文件 |
| Gemini Omni 1.1 Flash | 以对话方式理解修改要求,并结合文字、图像与视频素材进行创作 |
谷歌将这一方向概括为帮助创作者把“rough cuts”——也就是粗剪素材——推进到更完整、更适合制作和发布的成片。这里需要区分的是,较高分辨率导出属于 Flow 的产品交付能力,并不等同于所有 Omni Flash 生成任务都原生以 4K 输出。Google Flow 的帮助文档显示,不同模型支持的功能并不相同,用户在生成前还需要查看当前模型和对应的积分消耗,部分 Gemini Omni Flash 功能也受国家或地区限制。
起始帧和结束帧,解决的是连续性问题
生成式视频最难处理的环节之一,是让镜头从一个明确状态自然地过渡到另一个明确状态。单独输入文字提示时,模型可能改变人物外貌、服装、场景细节或镜头方向;而在连续叙事中,这些微小变化会很快累积成明显的不一致。
起始帧与结束帧的控制,相当于为模型设定两个视觉锚点。创作者可以先确定镜头从哪里开始、最终要落到哪里,再让系统补足中间的动作和转场。对于角色穿越场景、时间变化、广告产品展示和风格化转场,这种方式比只依赖文字描述更容易控制结果。
谷歌此前在 Flow 的 Veo 更新中已经推出过“Frames to Video”能力:用户提供一张开始图像和一张结束图像,由系统生成连接两者的连续视频。该更新还将“Ingredients to Video”与“Extend”等功能加入音频支持,并允许用户通过插入元素或延长片段继续调整场景。此次 Gemini Omni 1.1 Flash 更新,可以看作是在这条产品路线上的进一步推进——从基于关键帧生成,走向更强调对话式修改和成片控制的工作流。
Flow正在从生成器变成创意工作台
Google Flow最初以面向电影创作者的AI filmmaking tool进入市场,核心能力来自Veo模型。谷歌在5月的产品更新中表示,Flow已经扩展为包含视频和图像生成、编辑能力的AI创意工作室,并在140多个国家和地区推出。那次更新还把Gemini Omni Flash、Flow Agent和自然语言创建自定义工具纳入同一套产品体系。
Gemini Omni Flash的产品逻辑,是让用户通过对话反复编辑视频:改变环境、镜头角度、风格或特定细节,同时尽量保留原有场景的连续性。谷歌的模型文档则将其描述为支持文本、图像、音频和视频输入的多模态模型,并提供生成、视频编辑、参考素材到视频等任务模式。
这意味着Flow的竞争重点正在发生变化。过去,AI视频产品主要比较谁能生成更逼真的几秒钟片段;现在,创作者更关心的是能否固定角色、延续镜头、批量修改资产,并最终输出符合发布要求的文件。此前,谷歌已经在 Google Vids中加入Gemini Omni和个人头像,把类似的对话式视频生成和编辑能力带入办公场景。Flow则更集中于影视、广告和独立创作等需要更强视觉控制的工作流。
订阅、地区和模型差异仍是使用门槛
产品能力增加,并不意味着所有用户在任何地区都能使用全部功能。Google Flow帮助页面明确提示,不同模型对应不同特性;Gemini Omni Flash的部分功能存在国家限制。平台也会根据所选模型和功能计算不同的AI积分消耗。
这类分层会直接影响创作者的实际选择:用户可能用成本较低的模型完成草稿,再使用更高质量的模型进行关键镜头生成,最后通过1080p或4K导出完成交付。对于需要大规模生成多个版本的团队,分辨率、片段长度、模型质量和积分价格之间的平衡,可能比单项画质演示更重要。
谷歌也在继续把视频工具与更广泛的创作产品连接起来。Google Flow Music近期推出的 Lyria 3.5更新强调逐段编辑、整首歌曲重塑和音乐视频生成。视频和音乐产品的共同方向,是把一次性生成变成“生成—修改—改编—发布”的连续流程。
更高分辨率并不自动等于专业制作
1080p和4K导出会降低生成素材进入后期制作时的分辨率障碍,但它不能单独解决专业视频制作中的所有问题。镜头之间的表演连续性、对白和口型、复杂运动、版权素材、音频混音以及最终调色,仍然需要创作者检查和修整。
同样,起始帧和结束帧提供的是更强的约束,而不是对中间每一帧的完全控制。模型如何填补两个锚点之间的动作,仍可能受到提示词、参考素材和场景复杂度影响。因此,Flow更像是在压缩传统制作流程中的部分环节,而不是取代完整的剪辑软件或制作团队。
接下来需要观察什么
这次更新显示,谷歌正把AI视频产品的评价标准从“能否生成”推向“能否稳定交付”。后续值得关注的包括:
- Gemini Omni 1.1 Flash的1080p和4K导出具体适用于哪些模型、订阅层级和地区;
- 起始帧与结束帧功能在长镜头、复杂动作和多角色场景中的稳定性;
- 谷歌是否会公开更完整的模型规格、质量评测和积分价格;
- Flow生成内容的SynthID标识、商业使用范围及版权说明如何随工作流扩展而变化。
目前可以确认的是,Google Flow正在从一个“用提示词生成视频”的产品,转向一个包含参考素材、连续性控制、对话式编辑和高分辨率导出的创意工作台。对于创作者而言,这可能意味着更少的返工;对于谷歌而言,则是在视频生成竞争进入产品化阶段后,争夺完整创作流程入口的一次尝试。
本文依据谷歌关于 Google Flow与Gemini Omni的产品更新、Veo 3.1与Flow编辑能力的说明、Gemini Omni Flash开发者文档以及Google Flow帮助文档整理。具体可用功能和导出规格以用户所在地区、订阅层级及产品界面显示为准。