产业 / 媒体
谷歌将音乐生成模型 Lyria 3.5 集成至 Gemini,支持一键生成数分钟完整歌曲
谷歌于2026年9月5日宣布,将旗下最新音乐生成模型 Lyria 3.5 正式集成至 Gemini 应用及 Gemini API,标志着谷歌音乐 AI 从此前的内部实验工具 Google Flow Music 迈向面向大众用户与开发者的主流生态。此次上线共提供两种模型:Lyria 3 Clip 专注于生成30秒循环预览片段,而 Lyria 3.5 则能够生成包含多段副歌、桥段等结构完整、时长达数分钟的歌曲。开发者可通过 Google AI Studio、Vertex AI 及 Gemini API 调用上述模型,并可在文本提示之外同时提供最多10张图像,模型将结合视觉内容进行音乐创作。所有生成内容均嵌入可抵抗压缩与重采样的 SynthID 隐形水印,以支持版权追踪与内容溯源。目前官方文档尚未披露定价信息。
谷歌于2026年9月5日正式宣布,将音乐生成模型 Lyria 3.5 集成至 Gemini 应用与 Gemini API,这一举措标志着谷歌音乐 AI 能力从内部实验阶段正式走向主流用户与开发者生态。此前,相关功能主要以 Google Flow Music 的形式在内部测试,此次上线意味着更广泛的用户群体将能够直接体验 AI 音乐生成能力。
本次发布共涵盖两种模型。Lyria 3 Clip(模型 ID:lyria-3-clip-preview)专为循环和预览场景设计,固定输出30秒音频片段;Lyria 3.5(模型 ID:lyria-3.5)则面向完整创作需求,能够生成包含多段副歌、桥段等完整结构的歌曲,时长可达数分钟。两种模型均默认输出 MP3 格式,Lyria 3.5 还额外支持 WAV 高质量音频输出。
在开发者接入层面,Lyria 3.5 同步通过 Google AI Studio、Vertex AI 及 Gemini API 开放调用接口,为应用开发者提供灵活的集成路径。值得关注的是,开发者在提交文本提示的同时,还可附上最多10张图像,模型将依据视觉内容的风格与情绪进行音乐创作,为多模态内容生产提供了新的可能性。
所有通过 Lyria 3.5 生成的音频内容,均经由 Interactions API 统一调度,并在生成阶段自动嵌入谷歌自研的 SynthID 隐形水印技术。该水印具备较强的鲁棒性,能够抵抗压缩、重采样等常见音频处理操作,可用于后续的版权追踪与内容溯源,有助于在 AI 生成内容大量涌现的背景下维护创作权益。
目前,谷歌官方文档尚未披露 Lyria 3.5 的具体定价方案。随着音乐 AI 赛道竞争持续升温,Lyria 3.5 的正式开放将进一步考验谷歌在商业化路径与创作者生态建设方面的布局能力,其定价策略与开发者采用情况值得持续关注。
要点
- 谷歌将 Lyria 3.5 集成至 Gemini 应用与 API,音乐 AI 能力从内部实验正式走向主流生态
- Lyria 3.5 支持生成含副歌、桥段等结构的数分钟完整歌曲,并额外支持 WAV 格式输出
- 开发者可同时提供最多10张图像作为创作参考,实现文本与视觉双模态驱动的音乐生成
- 所有生成内容自动嵌入 SynthID 隐形水印,可抵抗压缩与重采样,支持版权追踪与溯源
- 定价方案尚未公布,商业化路径与开发者生态建设仍有待观察
原始标题:谷歌最强音乐 AI Lyria 3.5 塞进 Gemini:一键生成 3 分钟完整歌曲
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。