谷歌推出音乐生成模型Lyria 3.5,接入Gemini与API

会懂网AI资讯,9月5日,谷歌在Gemini应用与API中推出全新的音乐生成模型Lyria 3.5。这是谷歌在生成式音频领域的又一次迭代,与此前发布的Gemini 3.8 Flash一同构成其”多模态能力全面开花”的产品节奏。

谷歌推出音乐生成模型Lyria 3.5,接入Gemini与API

音乐生成是生成式AI最具挑战性的方向之一。与文本、图像不同,音乐具有强时间连续性、复杂结构与情感表达要求,模型不仅要在局部生成悦耳的音符,更要在整体上维持旋律、节奏与配器的协调统一,这对长上下文建模提出了极高要求。
Lyria 3.5以API形式开放,意味着开发者可以将音乐生成能力直接集成到自己的产品中。无论是短视频配乐、游戏音效、广告背景音乐,还是个性化的音乐创作助手,都有了低成本、可规模化的生成方案。
从谷歌的产品布局看,音频生成正成为其多模态矩阵的重要一块。此前谷歌已在图像(Imagen)、视频(Veo)、代码等领域推出生成模型,Lyria系列的持续迭代,补全了音频这一关键模态。
业内分析认为,生成式音频的商业化路径正逐步清晰。随着版权合作机制的成熟与生成质量的提升,AI音乐有望在内容创作、营销、教育等领域率先落地,成为继图像生成之后的下一个爆发点。
可以预见,随着Lyria 3.5等模型的能力持续提升,音乐创作的门槛将进一步降低,普通人也能用AI把自己的旋律灵感变成完整的作品。
会懂网观察,Lyria 3.5的推出,标志着谷歌在多模态生成领域的布局进一步深化。当文本、图像、视频、音频、代码全部被生成式模型覆盖,AI作为”全能内容引擎”的轮廓正变得愈发清晰,这将深刻改变内容生产的成本与效率结构。

© 版权声明
THE END
喜欢就支持一下吧
点赞11 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容