Lyria 3.5 完全指南:提示词、歌曲结构与中文歌词

Lyria 3.5 完全指南:提示词、歌曲结构与中文歌词

Lyria 3.5 的提示词怎么写:一条提示词里值得写清的六项、用时间戳定住结构、把自己写的词唱出来、用图片作曲,以及动手前该知道的限制。

先听听 Lyria 3.5

Lo-fi 学习节拍

纯音乐,Rhodes 电钢与唱片噪点

电影感推进

管弦,从钢琴推到全铜管

独立流行,有人声

人声,歌词是提前写好的

暗调 trap 节拍

纯音乐,D 小调的 808

法语香颂

人声,提示词用法语写

芯片音乐循环

纯音乐,复古 8-bit

Lyria 3.5 擅长什么

曲式撑得住两分钟

模型先把编曲规划完,再开始渲染。所以两分钟的曲子有前奏、有主歌、有副歌,不是一个动机循环到底。时间轴写进去,它就照着你的刻度往上搭。

一架掀开琴盖的音乐会三角钢琴,独自立在昏暗的厅堂里,一束光打下来

你写的词,它唱出来

歌词分好段,贴在段落标记下面,和音乐指令分开放。它唱的是这些字,不会当成对歌曲的描述。词由它自己写时,文本会跟音频一起交回来。

深色桌面上一台复古打字机,一张空白纸从卷筒里翘起,暖色台灯照着

配乐从画面里长出来

最多附十张静帧。模型读得出里面的情绪、色调和场景,照着写曲。把成片的画面直接喂进去,音乐贴的是调色本身,不是你对它的转述。

俯拍的摄影反转片平铺在发亮的看片灯箱上

纯音乐给人声让位

提示词里写明只要纯音乐,编曲就会在说话的位置留白。口播视频、课程讲解、播客片头、游戏内音乐,走的都是这一条。

排练室里的四把空椅子,上面搁着一把大提琴和一把小提琴,午后的光斜照进来

人声可以唱任何语言

提示词用哪种语言,歌词就是哪种语言,发音也跟着走。想要中文歌,整条提示词都得用中文写;在英文提示词里补一句“唱中文”不算数。

黄昏时分的巴黎屋顶露台,小咖啡桌上搁着一台手风琴

草稿便宜,才敢多试

Lyria 3 Clip 固定给 30 秒,出得快,提示词就在这一步磨顺。生成只有一轮,同一条提示词也不会重复,所以正式渲染要争取一次到位。

深色架子上一排磨旧的卡带,其中一盒被抽出来一点,硬光斜切过去

Lyria 3.5 提示词怎么写

提示词含糊,出来的音乐也含糊。没写清的地方,模型按它见过的一切取一个平均值。反过来说,每写清一项,就是把一个决定拿回自己手里。

短视频配乐最吃这一点。十五秒的片头,情绪必须一开口就对,没有铺垫的余地。

写清这一项为什么重要示例
曲风定下整首编曲的走向Lo-fi hip hop、国风流行、电影感管弦
乐器要具体音色,不要一个大类古筝、竹笛、Fender Rhodes、TR-808
速度一个数字胜过一个形容词85 BPM,慢一点约 70 BPM
调性从和声上把情绪定住G 大调、D 小调
情绪决定演奏的气质怀旧、凌厉、空灵
结构段落标记,或者一条时间轴[Verse] [Chorus],或时间戳

乐器写得具体,比曲风写得对更管用。写“古筝”,音色当场就定了;写“民族乐器”,模型只能给你一个平均值。

一段 30 秒的 lo-fi hip hop 节拍,带旧唱片的沙沙底噪。柔和的 Rhodes 电钢和弦,85 BPM 的慢速 boom-bap 鼓组,再配一条爵士味的立式贝斯。只要纯音乐,适合压在口播下面。

Lyria 3.5 的歌曲结构怎么控制

声音对了,再来定形状。控制分两层,多数人只用到第一层。

段落标记负责分段:[Intro][Verse][Chorus][Bridge][Outro]。只在乎先后顺序时,这一层够用。

时间戳负责对表。把时间轴写进去,模型按刻度搭,时长也一并定死。

[0:00 - 0:10] Intro:柔和的 lo-fi 节拍起头,配上闷闷的唱片噪点。[0:10 - 0:30] Verse 1:加入温暖的 Fender Rhodes 电钢旋律,人声轻唱一个下雨的清晨。[0:30 - 0:50] Chorus:全乐队进入,鼓点上扬,合成器主音铺开,歌词明亮而有希望。[0:50 - 1:00] Outro:只剩钢琴旋律,慢慢淡出。

这一层是让音乐跟着画面走的关键。剪辑上的入点和出点抄进提示词,写成一段一段,情绪推上去的地方就落在剪辑点上。短剧的反转、带货视频的转场,都是这么对齐的。不写时间戳,就用一句话交代,比如“做一首两分钟的歌”。

在 Lyria 3.5 里用自己写的歌词

歌词贴进去,段落打上标记。它是唱你的词,还是把词改写成描述,只取决于一条:**歌词和音乐指令分开写。**先写音乐指令,歌词单独成块跟在后面。

创作一首梦幻感的独立流行歌,歌词如下:[Verse 1] 末班地铁开过江面,玻璃上是我自己的脸,一整年的话都没说完,风把它们吹散在江边。[Chorus] 我们是夜里没熄的灯,比路更长比风更轻,别松手,再走一程,我们是夜里没熄的灯。

不写歌词,模型自己写,写完连文本一起交回来。就算你打算自己填词,这一步也值:先生成一版,在它给的词上改,比对着空白页强。要压在对白底下的音乐,加一句“只要纯音乐,不要人声”。

Lyria 3.5 的图片输入与中文歌词

**想要中文歌,整条提示词就用中文写。**曲风、乐器、情绪,全都写中文,人声的发音才会跟着中文走。这里有个常见的坑:一条英文提示词写着“唱一首中文歌”,它本质上仍然是英文提示词,多半还是给你英文人声。

**图片也能定下配乐。**最多附十张静帧,模型会读里面的情绪、色调和场景,照着作曲。把自己时间线上的画面喂进去,音乐贴的是成片的调色,比文字描述准得多。

创作一首温柔的中文流行歌,写小城夏夜的一场告别。钢琴和木吉他伴奏,人声干净克制,副歌不要拔太高。

Lyria 3.5 的工作流与限制

先用 Lyria 3 Clip 打草稿。它固定返回 30 秒,出得快。提示词定稿之后,再交给 Lyria 3.5 渲染完整歌曲。曲子要进剪辑,就把输出从 MP3 换成 WAV。

完整歌曲在两分钟上下,44.1 kHz 立体声。短视频配乐、口播背景、店铺宣传片,这个长度和规格拿过去直接能用。

这个顺序不是习惯问题,是下面四条限制逼出来的。

限制意味着什么该怎么办
单轮生成没有“把副歌做大一点”这种追加指令改提示词,重新生成
结果不可复现同一条提示词不会出第二首一样的看中哪版立刻下载
安全过滤点名歌手、贴受版权保护的歌词都会被拒描述嗓音,不要写歌手名
SynthID 水印每首曲子都标记为 AI 生成不用管,人耳听不出来

常见问题

Lyria 3.5 能唱中文吗?

能。歌词是什么语言,由提示词是什么语言决定。所以中文歌要从头到尾用中文写,曲风、乐器、情绪这些指令也不例外。只在英文提示词里补一句“唱中文”,拿回来的通常还是英文人声。自己写好的中文词照样这么放:单独成块,跟在音乐指令后面。

Lyria 3.5 的歌曲时长怎么控制?

两个办法。一是用话直接说,比如“做一首两分钟的歌”。二是写一条带时间戳的时间轴,最后一个刻度就是结尾。时间戳更准,因为它顺手把每一段放在哪也定了。Lyria 3 Clip 两招都不吃,它每次只给 30 秒。

Lyria 3.5 和 Lyria 3 Clip 有什么区别?

Clip 固定 30 秒,为快速试错而做,输出 MP3。Lyria 3.5 出的是完整歌曲,两分钟上下,主歌、副歌、桥段分得清楚,还能输出 WAV。推荐两个搭着用:提示词在 Clip 上磨顺,留下来的那一版交给 3.5 渲染。

可以在 Lyria 3.5 里用自己写的歌词吗?

可以。把歌词写进提示词,用 [Verse]、[Chorus]、[Bridge] 标出段落。关键是让歌词单独成块,别和音乐指令混在一起。混着写,模型往往把这些字当成对歌曲的描述,而不是要唱出来的词。

怎么生成没有人声的纯音乐?

在提示词里写明“只要纯音乐,不要人声”。两个模型都认这句话。口播视频的背景、课程讲解、游戏内音乐,凡是要压在说话底下的,都这么写。

Lyria 3.5 的提示词为什么被拒了?

基本上就两种情况。一种是点名了某位歌手的嗓音或风格,另一种是提示词里带了受版权保护的歌词。安全过滤这两样都拦。改法是把想要的特质描述出来:音色偏哪儿、口音什么样、演唱克制还是外放,别把拥有这些特质的人写进去。

Lyria 3.5 的音质是什么规格?

44.1 kHz 立体声,和 CD 母带同一个采样率。默认输出 MP3。要拿无损文件进剪辑或混音,Lyria 3.5 也可以给 WAV。

Lyria 3.5 能根据图片作曲吗?

能。文字提示词之外,最多再附十张图片,模型会读出里面的情绪、色调和场景,照着写曲。想让配乐贴合成片,这是最稳的一条路:静帧里带着的信息,用文字只能说个大概。