谷歌为 Google Vids 加入 Gemini Omni 和个人头像,继续推进 AI 视频创作
谷歌为 Google Vids 推出 Gemini Omni 和 personal avatars,新功能支持对话式视频生成与编辑,以及通过自拍和短语音生成近似用户外观与声音的数字头像,从而简化无真人出镜的视频制作流程,同时对高级功能设置订阅与地区限制。
谷歌为 Google Vids 推出 Gemini Omni 和 personal avatars,新功能支持对话式视频生成与编辑,以及通过自拍和短语音生成近似用户外观与声音的数字头像,从而简化无真人出镜的视频制作流程,同时对高级功能设置订阅与地区限制。
Google 周四在官方博客 Google Workspace Blog 发布更新,给视频创作工具 Google Vids 增加了两项新功能:Gemini Omni 和 personal avatars(个人头像)。谷歌表示,这意味着用户现在可以用更接近日常表达的自然语言来生成、编辑和微调高质量视频,也可以通过上传自拍照和一段简短录音,让一个“像自己”的数字头像直接出镜。
从“会剪”到“会说”
按谷歌的说法,Gemini Omni 的作用是把视频编辑流程进一步对话化。用户不必先进入传统时间轴里反复拖拽素材,而是可以直接输入提示词,要求系统生成镜头、修改背景、调整光线,或者在已有片段上继续迭代。对熟悉 Google 今年 I/O 2026 相关发布的人来说,这一方向并不陌生:AIFlux 先前整理过 Gemini Omni 与 3.5 Flash 演示要点,其中重点就包括对话式视频编辑和多模态输入。
这次 Vids 的变化,实质上是把这类能力进一步压进 Google Workspace 的日常创作场景里。谷歌在文章里强调,用户可以先用文本提示或图片参考生成内容,再在同一流程里继续修改,而不是每一步都切换到不同工具。
个人头像功能补上“出镜”环节
另一项更新 personal avatars,则更直接地瞄准“没人想上镜,但又要做视频汇报”的使用场景。用户上传一张自拍和一段短语音后,就能生成一个外观和声音都接近自己的数字头像,再让它代替真人出镜讲述内容。谷歌把这项能力描述为一种不必架机拍摄、也不必反复录制的替代方案。
从产品逻辑看,这也是谷歌近几个月持续推进的方向之一:把生成式能力拆成更细的模块,分别覆盖“生成画面”“编辑画面”“替代出镜”几个关键环节。早在今年 4 月 2 日,谷歌就已经在另一篇 Vids 公告中宣布向所有 Google 账户开放高质量视频生成、定制音乐和 AI 头像等能力,文章标题为 Create, edit and share videos at no cost in Google Vids。
商业化分层继续清晰
谷歌这次也明确了可用范围:Gemini Omni 和 personal avatars 面向 Google AI Pro、Ultra 订阅用户,以及 Google Workspace 商业客户;其中 personal avatars 目前只面向部分地区、且年满 18 岁的用户开放。谷歌同时表示,所有生成的视频片段都会带有不可见的 SynthID 数字水印,用于标记内容来自 AI 生成。
这种设计说明,Vids 仍然不是一款完全对所有人开放的“通用视频编辑器”,而更像是 Google 把 AI 生产力订阅、Workspace 套件和消费级创作入口捆在一起的一次尝试。对小团队、营销人员、培训部门和独立创作者来说,门槛确实在下降;但更高阶的生成、编辑和出镜能力,依旧被放在付费和地区限制之后。
如果把它放在更大的趋势里看,Google 仍在押注“生成媒体”会像文档、表格那样,成为工作流中的基础层能力。AIFlux 之前在 生成媒体如何重塑初创公司 中提到,随着视频与多模态生成变得更便宜、更易用,创始人的角色会越来越接近“创意总监”而不是单纯的技术操作者。Google Vids 的这轮更新,正是这种变化在办公产品中的一个新切口。
不错过任何一条 AI 大事
订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

