音频模型

Lyria 3

Google DeepMind 的音乐生成模型——最长三分钟的高保真 48kHz 音频,通过 Vertex AI 与 Gemini API 提供。

Lyria 3 是 Google DeepMind 的音乐模型,于 2026 年 2 月 18 日发布,是 Lyria 2(2025 年 5 月)的继任者。它生成最长约三分钟的高保真 48kHz 立体声音频,直接作用于音频 token 而非频谱图,并整合了 DeepMind 对 ProducerAI 的收购。SynthID 水印为强制,用于溯源。

接入通过 Vertex AIGemini API,这使它天然契合已身处 Google 生态的团队——生成背景与制作音乐,或基于 Lyria RealTime 构建实时、可控的生成。

它的局限在于覆盖与侧重,而非纯粹的质量:歌词与人声处理弱于 Suno 或 Udio,接入也绑定 Google 平台,而非作为独立的消费级工作室提供。当集成、实时控制与溯源比社区和独立工具更重要时,选它。

适用场景

  • Google 工具内的背景与制作音乐
  • Vertex AI 上的企业音乐生成
  • 实时/交互式音乐(Lyria RealTime)

优缺点

优势

  • 高保真 48kHz 立体声,最长约 3 分钟
  • 与 Vertex AI 和 Gemini API 集成
  • SynthID 水印保障溯源;Lyria RealTime 用于实时

局限

  • 歌词/人声处理弱于 Suno/Udio
  • 接入绑定 Google 平台

来源

最后更新:2026-06-18 · 规格与价格变动很快——使用前请在厂商官网核实。