AI 音乐

Google 将 Lyria 3.5 音乐生成模型接入 Gemini 和 Gemini API

Google 宣布 Lyria 3.5 已进入 Gemini App 和 Gemini API,将 AI 音乐生成能力扩展到普通用户、创作者和开发者。

发布于 更新于
GoogleGeminiLyria生成式 AI

Google 正在把最新音乐生成模型推向更广泛的 Gemini 生态。公司 9 月 4 日宣布,Lyria 3.5 已经进入 Gemini App,并通过 Gemini API 向开发者开放。这意味着 Google DeepMind 的音乐生成能力不再只是实验室演示,而是开始成为面向普通用户、创作者、品牌和开发者的生产工具。

Google 称,Lyria 3.5 是其目前音质最好的音乐生成模型,能够生成更有表现力的人声和更丰富的编曲。在 Gemini App 中,用户可以选择或描述音乐类型,在人声和纯音乐风格之间切换,也可以用模板快速生成背景音乐、生日歌曲、品牌短旋律等内容,并选择较短或较长的曲目长度。Google 还表示,该模型已经面向全球用户在 Gemini 网页版和移动端开放,艺术家和 AI 创作者可以在 Google Flow Music 中使用,开发者则可以通过 Google AI Studio 和 Gemini API 调用,Google Vids 也接入了相关能力。

这次发布的意义在于,AI 音乐正在从单点演示进入日常创作流程。对视频创作者来说,定制背景音乐可以减少授权和素材匹配成本;对小企业而言,广告短曲和品牌音效可以围绕活动快速生成多个版本;对开发者来说,API 开放意味着音乐生成能够嵌入剪辑软件、营销工具、游戏、教育产品和互动应用,而不必让用户跳转到独立平台。

不过,AI 音乐仍是一个敏感市场。生成式音乐工具长期伴随版权、训练数据、艺术家同意和商业使用边界等问题。Google 这次公告主要强调可用性和创作控制,并未在公告中展开讨论权利管理细节,因此专业用户在采用 Lyria 3.5 前仍需要关注输出授权、平台条款以及商业分发规则。即便如此,产品方向已经很清楚:Gemini 正从文本助手变成多模态创作入口,文字、图像、视频和音乐能力正在被放进同一个使用场景。

对 AI 行业而言,Lyria 3.5 也说明模型竞争不只看质量,还看它能否进入真实工作流。一个同时存在于消费应用、API、创意工具和视频产品中的音乐模型,比单独展示的模型更容易形成规模。Google 接下来的挑战,是让这种规模既带来便利,又避免生成内容千篇一律或在版权上留下不确定性。