应用与产品

谷歌在 Google Flow Music 中推出 Lyria 3.5,继续把音乐生成推向“可编辑、可控、可交付”

谷歌在 Google Flow Music 中发布 Lyria 3.5,提升音乐性、歌词和人声质量,并将生成能力扩展为可分段编辑、整首重塑和生成音乐视频的创作工作流。此次升级强调把音乐生成从单一模型输出转向“生成—编辑—改编—发布”的闭环创作平台,后续可用范围与版权和水印策略仍需观察。

谷歌在 Google Flow Music 中推出 Lyria 3.5,继续把音乐生成推向“可编辑、可控、可交付”

谷歌在 Google Flow Music 中发布 Lyria 3.5,提升音乐性、歌词和人声质量,并将生成能力扩展为可分段编辑、整首重塑和生成音乐视频的创作工作流。此次升级强调把音乐生成从单一模型输出转向“生成—编辑—改编—发布”的闭环创作平台,后续可用范围与版权和水印策略仍需观察。

谷歌正在把音乐生成从“能不能生成一首歌”推进到“能不能更像一条创作工作流”。在 Google DeepMind 的 Lyria 3.5 页面 上,谷歌把新一代音乐模型描述为在音乐性、歌词和人声质量上都有明显提升;与此同时,Google Labs 的 Flow 更新文章 也把 Google Flow Music 继续放在更完整的创作链路里,强调分段编辑、整首歌重塑和音乐视频生成。

这次升级到底改了什么

从公开页面看,Lyria 3.5 的重点不是单纯“更会写歌”,而是让生成结果更接近可实际使用的创作素材。DeepMind 在模型页中写得很直接:这是“最新的音乐生成模型”,在 musicality、lyrics、vocal quality 三个维度上都有进步,目标是让创作者做出“更丰富的曲目”。页面同时继续强调,Lyria 3 体系支持最长约 3 分钟的连续曲目、图像转音乐和更细致的声音控制。

而在 Google Flow Music 里,谷歌已经把这种能力往更细的制作环节推进。Google Labs 在 5 月的更新中写道,Flow Music 不再只是一个“输入提示词、输出音频”的工具,而是可以:

  • 逐段修改歌曲,重写或翻译歌词,调整某一段的鼓点和风格,而不影响整首歌的其他部分;
  • 把整首歌重新包装成不同风格的版本,同时保留原始旋律和结构;
  • 结合 Gemini Omni 生成可分享的音乐视频。

换句话说,谷歌想卖的已经不是单个模型,而是一整套“生成—编辑—改编—发布”的闭环。

Flow Music 正从实验室产品变成创作平台

这条产品线的节奏其实很清楚。3 月,谷歌先发布 Lyria 3 Pro,把可生成的曲目长度拉到 3 分钟,并允许提示词明确指定 intros、verses、choruses 和 bridges。随后在 5 月,谷歌又在 Google Flow 与 Flow Music 的更新 中加入 Gemini Omni、Flow Agent 和移动端应用,把 Flow Music 推向更接近“创意操作系统”的位置。

这种做法与谷歌在其他生成式产品上的思路一致。AIFlux 先前报道的 Google Vids 更新 也显示,谷歌正把 Gemini Omni、个人头像等功能嵌入视频创作流程,目标是让生成式能力直接进入办公与内容生产场景,而不是停留在单独的演示页。

从这个角度看,Lyria 3.5 更像是谷歌把同一套产品哲学继续复制到音乐领域:先提高可控性,再把能力嵌进具体工作流。

为什么这次升级会被关注

音乐生成赛道这两年已经从“谁能生成一段像样的旋律”变成“谁能把一整套创作流程做顺”。谷歌并不是最早入场者,但它的优势在于入口多:DeepMind 模型页、Flow Music、Gemini、Google Vids,甚至 Gemini 应用本身,都可以成为同一个能力的分发点。

过去几个月,谷歌已经多次围绕这条线加码:

  • 2025 年,DeepMind 先通过 Music AI Sandbox 和 Lyria 2 打磨音乐生成;
  • 2026 年初,Lyria 3 被引入 Gemini 应用,主打 30 秒音轨与图片生成音乐;
  • 3 月的 Lyria 3 Pro 将长度和结构控制继续推进;
  • 到现在,Lyria 3.5 则把重点放回“更好的声音”和“更自然的歌词结构”。

在外部报道里,这条路线也早就被视为谷歌对 Suno、Udio 等 AI 音乐工具的正面回应。TechCrunch 在 3 月的报道中写到,Lyria 3 Pro 把单曲长度从 30 秒拉到 3 分钟;The Verge 则把它总结为“从 30 秒到 3 分钟”的明显跃升。现在看,Lyria 3.5 更像是在这个基础上继续补“音质”和“可编辑性”的短板。

还需要观察什么

目前公开信息已经足够说明谷歌的方向,但还有几件事没有完全说清:

  • Lyria 3.5 的实际可用范围,是只限 Flow Music,还是会继续扩展到 Gemini、Vids 和开发者接口;
  • 谷歌是否会公开更细的 benchmark、模型卡或地区/订阅限制;
  • 升级后的歌词、人声和结构控制,和竞品相比是否真的更稳定;
  • 在版权、训练数据和水印标记方面,谷歌会不会继续强化 SynthID 等安全说明。

就目前公开材料来看,谷歌已经把 Lyria 3.5 放进了一个更清晰的商业叙事:生成式 AI 不再只是“生成内容”,而是要直接进入创作、修改和分发的每个环节。对音乐创作者而言,这意味着工具链更短;对谷歌而言,这意味着 Flow Music 不只是一个功能,而是它想建立的下一层创作入口。

不错过任何一条 AI 大事

订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

相关阅读