近日,谷歌旗下 Flow 音乐平台正式发布了最新一代音乐生成模型——Lyria 3.5。这一升级标志着谷歌在AI音乐创作领域迈出了关键一步,新模型搭载了多项高阶音乐生成功能,能够根据用户输入的文本、旋律或风格关键词,生成结构完整、情感丰富的音乐作品,甚至支持多轨编曲与人声合成,进一步模糊了人工智能与人类创作之间的界限。

从“辅助工具”到“创作伙伴”:Lyria 3.5 的技术跃迁

自2023年谷歌推出初代Lyria模型以来,Flow平台一直致力于降低音乐创作门槛。此前的版本主要实现简单的旋律生成与和弦建议,而Lyria 3.5则实现了质的飞跃。据悉,该模型基于谷歌最新的Transformer架构与扩散模型融合技术,参数量达到百亿级别,能够同时处理音高、节奏、音色、动态等多维度音乐信息。

在功能层面,Lyria 3.5 具备三大核心亮点。首先是“多模态音乐生成”,用户不仅可以通过文字描述(如“一段轻快的钢琴独奏,带有爵士和声”)生成音乐,还可以直接哼唱或演奏一段旋律作为输入,模型会自动进行风格化扩展与编曲。其次是“结构化长程生成”,解决了此前AI音乐容易“后半段跑调”或“节奏混乱”的痛点,新模型能够生成3分钟以上的完整乐曲,并保持主题一致性。最后是“人声与乐器分离合成”,模型可分别生成主唱、和声以及多种乐器音轨,支持用户后期独立编辑。

重塑创作流程:从专业工作室到个人客厅

Flow平台产品负责人Sarah Chen在发布会上表示:“Lyria 3.5 的目标不是取代音乐人,而是赋予每个人表达音乐的能力。我们希望让一个从未学过乐器的用户,也能在10分钟内创作出一首属于自己的作品。”

为了实现这一目标,谷歌对Flow界面进行了重新设计,推出“灵感模式”和“精调模式”两种交互形态。前者适合快速试听,用户只需输入几个关键词,模型就会生成多个版本供挑选;后者则面向进阶用户,提供音轨分轨编辑、动态曲线调整、效果器叠加等专业功能,甚至允许用户导入自己的MIDI文件作为生成基础。

据透露,Lyria 3.5 已内置超过200种音乐风格与3000种乐器音色库,涵盖古典、电子、流行、世界音乐等主流类型,并支持方言人声生成(如中文普通话、粤语、日语等)。这意味着即使是小众音乐类型,用户也能获得相对专业的生成效果。

行业震动与版权争议:AI音乐的双刃剑

Lyria 3.5 的发布无疑将对音乐行业产生深远影响。一方面,它大幅降低了音乐制作成本,独立音乐人和业余爱好者可以绕过昂贵的录音棚与乐手费用,快速完成Demo录制。另一方面,版权与原创性问题再次成为焦点。此前,环球音乐集团等主流唱片公司曾对AI音乐训练数据的版权提出质疑,认为使用受版权保护的音乐训练模型构成侵权。

针对这一争议,谷歌此次特别强调起了“负责任AI”策略。据官方声明,Lyria 3.5 的训练数据主要来自无条件授权的开源音乐库、公共领域作品以及自建合成音频,并引入了“水印嵌入技术”——每一首由AI生成的音乐都包含不可感知的音频指纹,用以追溯来源。此外,谷歌还与多家独立版权组织合作,推出“AI音乐创作者补偿计划”,若用户因商业用途使用AI生成音乐获利,平台将按比例向原风格贡献者支付分成。

生态布局:Flow的野心不止于生成

值得注意的是,Flow平台并非孤立产品。它深度整合了谷歌旗下YouTube Music、Google Play以及AI音乐实验室Magenta的资源。用户生成的音乐可直接一键发布至YouTube Shorts或上传至SoundCloud风格社区,形成“创作-分享-变现”的闭环。同时,Lyria 3.5 还支持与Google Colab、TensorFlow等开发工具联动,允许研究者自定义训练子模型。

市场分析人士指出,谷歌此举意在抢占AI+音乐的生态入口。目前,OpenAI的Jukebox、Meta的AudioCraft以及初创公司Suno AI均已推出类似产品,但Lyria 3.5 在生成稳定性与多语言支持上展现了一定优势。随着模型版本的迭代,AI音乐或许将很快从“新奇玩具”转变为“生产力工具”。

结语:创作平权的时代来了吗?

当一段完整的交响乐可以在几秒钟内由文字生成,当没有乐理知识的人也能在社交平台上发布自创歌曲,我们不禁要问:音乐创作的本质是否被改变了?谷歌的回答是:技术提供工具,但灵感与情感依然属于人类。Lyria 3.5 的发布无疑将加速这一进程,但最终,音乐是否打动人,或许仍取决于使用它的人。

截至目前,Flow平台已向部分测试用户开放Lyria 3.5 的试用,预计将在下个月面向全球用户推出正式版。对于每一个怀揣音乐梦想的人而言,最好的时代或许真的来了。