谷歌在生成式AI音乐创作领域再推新动作,正式发布新一代AI音乐生成模型Lyria 3.5,并将其整合至Google Labs旗下的音乐创作工具Flow Music。此次升级聚焦音乐性、歌词生成、AI人声及创作控制四大维度,旨在为用户提供更自然、结构更完整且情感表达更丰富的歌曲生成体验。在OpenAI、Suno、Udio等厂商激烈竞争的背景下,谷歌正通过技术迭代强化其“文本到完整歌曲”的生成能力,试图构建覆盖创作、编辑到生成的一站式AI音乐平台。
据谷歌介绍,Lyria 3.5在音乐表现力上实现显著突破。新模型能够生成更复杂的旋律结构,使音乐整体更流畅自然,歌曲编排更贴近真实创作逻辑,避免简单重复的循环模式。歌词生成方面,模型对用户提示(Prompt)的理解能力进一步提升,可生成结构更合理、质量更高的歌词,段落衔接与整体连贯性均得到优化。
AI人声是此次升级的核心亮点。谷歌称,Lyria 3.5生成的人声在自然度和情感表达上更接近真人,发音准确率显著提高,同时支持用户对歌曲节奏和生成长度进行精细控制。例如,用户可调整演唱速度或指定歌曲时长,从而获得更符合创作需求的输出结果。
创作控制能力的增强是另一大改进。Flow Music不再局限于一次性生成音乐片段,而是允许用户通过自然语言提示持续修改歌曲。从旋律、歌词到风格、节奏甚至整体氛围,用户均可迭代调整,无需每次重新生成整首作品。谷歌表示,这一设计旨在让AI成为创作伙伴,而非单纯工具,帮助用户“创作真正喜欢的歌曲”,而非仅生成音乐Demo。
Lyria系列模型是谷歌DeepMind在AI音乐生成领域的长期布局。今年2月,谷歌推出Lyria 3;3月底升级至Lyria 3 Pro,将歌曲生成时长从约30秒延长至3分钟,并支持用户自定义前奏、主歌、副歌等完整结构,使AI生成内容更接近专业制作流程。此次Lyria 3.5未公布新的基准测试成绩,而是将重点转向用户体验优化,如人声质量、歌词创作和创作控制。业内分析认为,这表明谷歌更关注AI音乐的实用性,而非单纯追求模型性能指标。
当前,AI音乐已成为生成式AI竞争的关键赛道。除谷歌外,Suno、Udio等初创公司快速崛起,OpenAI亦在探索多模态内容生成能力,各厂商围绕歌曲创作、音频编辑、人声生成等领域展开角逐。作为Google Labs创意工具矩阵的核心产品,Flow Music与Flow视频生成平台共同构建了谷歌的AI内容创作生态。随着Lyria 3.5的上线,谷歌希望将AI能力深度融入音乐创作全流程,覆盖从创意构思到歌曲生成与编辑的完整工作流,以巩固其在生成式创作领域的优势地位。











