音乐模型

Google 发布 Lyria 3.5 音乐生成模型:Gemini App、API、AI Studio 三端齐上线

2026年9月6日0 次阅读

draft — Google Lyria 3.5

导语

9 月 4 日,Google 宣布其最新音乐生成模型 Lyria 3.5 正式上线,且一改以往"消费端先行、API 半年后跟进"的节奏——这次 Gemini App、Gemini API 和 Google AI Studio 三端同时开放。这是 Google 自 7 月底在 Flow Music 中首发 Lyria 后,第一次把音乐生成能力完整交给普通用户和开发者。

核心升级

官方公告点名了四个方向的提升(基于官方博客与媒体解读整理):

  1. 音乐性:旋律结构更丰富自然,早期版本偏平铺、重复的编曲问题得到改善。
  2. 歌词遵循:模型对提示词中要求的verse/chorus/bridge结构的遵循度提高,更贴近用户指定的歌词。
  3. 人声表现:演唱更有感情,发音更准,口音处理也明显改善。
  4. 节奏与时长控制:可以在提示词里指定具体的歌曲长度(上限约 3 分钟)和节奏,而不是拿到模型默认时长。

三个入口分别给谁用

| 入口 | 面向人群 | 能做什么 |

|------|----------|----------|

| Gemini App | 普通用户、 casual 创作者 | 输入提示词直接生成整首歌,无需任何代码,成果留在 App 内 |

| Gemini API | 开发者 | 以编程方式调用 Lyria 3.5,接入自己的产品管线——和调用 Gemini 文本/代码接口是同一套 |

| Google AI Studio | 开发者原型验证 | 在浏览器里测试提示词、参数,确认效果后再写集成代码 |

另外 Google Flow Music 中也在使用 Lyria 系列。

关键参数

  • 单曲长度:最长约 3 分钟(Google 官方数字)
  • 水印:每首生成的音轨内嵌 SynthID 不可感知水印,可用于识别 AI 生成音频
  • 多语言人声:支持多语言演唱(官方未公布完整语言清单)

和 Suno / Udio 的定位差异

Suno 和 Udio 靠端到端生成整首歌起家(一次生成完整编曲、人声、结构),走独立消费 App 路线;ElevenLabs 则是从生产级语音合成切入音乐生成。Lyria 3.5 走的是第三条路:音乐质量同一档,但分发依托 Gemini 开发者栈——对开发者来说,如果已经在用 Gemini API 做文本/视觉任务,加音乐生成只是多调一个接口,不用接新供应商。

适合谁 / 注意事项

  • 适合:想在 Gemini 生态里做音乐生成的用户和开发者;需要 API 集成的产品团队
  • 注意:API 计价和配额档位在发布帖中没有单独披露,动手前先查当前 Gemini API 定价;商用授权条款 Google 没有在发布帖中单独列出,做付费产品前需自行确认

来源

  • Google AI Studio 官方公告: https://blog.google/innovation-and-ai/models-and-research/google-labs/lyria-3-5/
  • Google DeepMind Lyria 模型页: https://deepmind.google/models/lyria/
  • explainx.ai 解读: https://www.explainx.ai/blog/google-lyria-3-5-music-generation-gemini-2026

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...