音频生成

Lyria 3.5

由 Google DeepMind 提供

Google 目前最好听的音乐模型。
完整的歌:有结构、有人声、有歌词。

Lyria 3.5

核心功能

技术规格

Google

由 DeepMind 团队打造,Lyria 系列音乐模型出自这里。

44.1 kHz

高保真立体声,可输出 MP3 或 WAV。

约 2 分钟

完整歌曲,长度可以由提示词引导。

最多 10 张

除了文字,还能参考一组图片来作曲。

应用场景

昏暗的录音棚里,指挥在一盏顶光下只剩剪影

电影与预告片配乐

画面推到哪,音乐就涨到哪。把时间轴写进提示词,情绪的高点会落在剪辑点上,而不是差半拍。

一间排练室,椅子空着,午后的光里放着一把大提琴和一把小提琴

游戏配乐

菜单、探索、战斗各配一段器乐床。同一套音色底子做下来,整关听起来才像一部配乐。

昏暗的工作台上摆着一台调音台,深色显示器上是一条明亮的波形

广告与宣传片

三十秒的想法先用 Clip 试。方向对了,再用 Lyria 3.5 出完整版。

黄昏时分的巴黎屋顶露台,咖啡桌上放着一台手风琴

短视频与社交平台

给自己的账号做原创配乐。片子发出去,音频这一头不用再挂着一个授权问题。

深色架子上排着一列磨旧的磁带,硬侧光扫过

播客片头与转场

片头、转场和片尾用同一个动机写出来。一整季听下来像一个系列,而不是一堆散片。

暖色台灯下,一本手写的歌词本摊开在木吉他旁边

歌曲小样

自己写的词,先听成一版完整编曲,再去定录音棚。主歌副歌的结构,一段段标得清楚。

提示词示例

暖色灯光下的老式唱机,唱针落在转动的黑胶上

Lo-fi 器乐

一段 lo-fi hip hop 节拍,黑胶噪点,Rhodes 电钢和弦,85 BPM。纯器乐。

0:00
0:12
Edit prompt
一排调音台推子高低错落,琥珀色指示灯亮着

带时间轴的推进

[0:00-0:10] 前奏:轻柔钢琴。[0:10-0:30] 主歌:Rhodes 电钢加人声。

0:00
0:12
Edit prompt
空旷幽暗的大厅里,一把大提琴独自立在一束冷光下

电影感管弦

一首大气的管弦乐:钢琴独奏开场,弦乐进来,铜管推到高点。

0:00
0:12
Edit prompt
摊开的笔记本上横放着一支笔,旁边是一盏小台灯

用您的歌词写歌

一首梦幻感的独立流行歌。[Verse 1] 走在霓虹的光里。

0:00
0:12
Edit prompt

简单定价

今天就免费开始,随时可以升级或取消。

Basic

$9/
账单金额为 $0 每年

1100 每月 信用

1 个用户

所有模型

工作流

Standard

$24/
账单金额为 $0 每年

3625 每月 信用

1 个用户

所有模型

工作流

Pro

$45/
账单金额为 $0 每年

6350 共享 每月 信用

1 用户

+ 最多 4 人额外付费可增加

所有模型

工作流

Pro Max

$170/
账单金额为 $0 每年

24650 共享 每月 信用

1 用户

+ 最多 9 人额外付费可增加

所有模型

工作流

Enterprise

更高的限制

自定义

定价和账单条款

大容量信用
自定义席位限制
所有模型
工作流
Pricing Gradient

Free

供随意体验

$0

永久免费

最多 20 积分
仅1个用户
部分模型
工作流

常见问题

Lyria 3.5 是什么?
Lyria 3.5 是 Google DeepMind 的音乐生成模型。一段文字提示词进去,它先把编曲推演出来,再写词、演唱,交出一首完整的歌,输出 44.1 kHz 立体声。它是 Lyria 3 的后续版本,在音乐性、歌词质量、人声表现,以及对速度和时长的控制上都有提升。
Lyria 3.5 能唱中文吗?
能,而且做法很简单:整段提示词都用中文写。歌词的语言由提示词的语言决定,中文提示词回来就是中文演唱,模型的唱法和咬字也跟着调整。没有单独的语言开关要设。要注意的是,musical direction 和歌词要分开写,中文提示词也一样,这样它唱的才是您写的那几句。
Lyria 3.5 和 Lyria 3 Clip 有什么区别?
Clip 是短版本,每次固定返回 30 秒,所以适合用来低成本地试提示词。Lyria 3.5 生成的是约两分钟的完整歌曲,主歌、副歌、桥段分得清楚,而且只有它能输出 WAV。常见的做法是先在 Clip 上反复调,满意了再用 3.5 出完整版。
可以用自己写的歌词吗?
可以。把词写进提示词,用 [Verse]、[Chorus]、[Bridge] 这样的标记把段落分好,模型就知道整首歌的形状。另外把音乐方向的描述和歌词本身分开写。这一条是决定它唱您原文、还是把词改写一遍的最大因素。
能只出纯音乐、不要人声吗?
可以,在提示词里直接说明就行,比如“纯器乐,不要人声”。游戏音频、背景床,以及任何要压在旁白下面的音乐,通常都这么做。
Lyria 3.5 是什么时候发布的?
分两步。Google 先在 2026 年 7 月 29 日把它放进 Flow Music,再于 2026 年 9 月 4 日通过 Google AI Studio、Gemini API 和 Gemini 应用更大范围开放。只提到其中一个日期的报道,讲的是这次发布的一半。
Lyria 3.5 生成的音频有水印吗?
有。每一条音轨都带 SynthID 音频水印,可以据此识别为 AI 生成。水印听不出来,也不会改变音轨的听感。
生成之后还能再改吗?
不能靠再提一句要求来改。生成是单轮的,已经出来的音轨没法用一条后续指令去细调。要改就调整提示词重新生成,所以先在 Clip 上把想法试通会省不少时间。另外每次运行的结果都有差异,同一条提示词不会两次返回完全一样的音轨。