音频生成
已上线

ElevenLabs

由 ElevenLabs 提供

六种音频模式,一个工作区。
配音、音乐、音效设计、对话与变声器。

ElevenLabs

核心功能

聆听声音的广度

纪录片旁白语音

温暖、不赶时间的纪录片式朗读。

0:00
0:12
带人声的歌曲音乐

写好的歌词,唱成一首独立民谣。

0:00
0:12
夜晚环境声音效

蟋蟀、远处的狗吠、一辆车驶过。

0:00
0:12
双人场景对话

两个说话人,声音分明,一次生成。

0:00
0:12

技术规格

6

语音、音乐、音效、对话、变声器、转写

3,000字符

每次文字转语音生成

5秒至5分钟

纯器乐,或按您的歌词演唱

0.5至22秒

每段生成的音效

5,000字符

所有角色一次生成

最长5分钟

每次转换的源音频

应用场景

一条光带像说话的声波那样起伏收束

旁白与配音

为AI生成或实拍素材配旁白,按性别、年龄、口音和用途挑声音,不用一路翻列表。

一圈圈金色光弧像被拨响的和弦那样向外扩散

原创歌曲与配乐

用器乐铺底为视频配乐,或者写好歌词,拿回一首按指定风格唱完的成品。

无数发光的丝线从一个明亮的撞击点向外辐射

音效与声音设计

为一段剪辑做拟音、室内底噪和天气声,无需授权,每个瞬间要多长就设多长。

两条光带,一条琥珀色一条青灰色,交织在一起

播客与广播剧

做片头、旁白段落和完整的多人场景,每个角色有自己的声音和演法。

一缕温暖的光线朝着黑暗深处远远退去

有声书旁白

长篇朗读,各章语速和语气一致,分段生成,可以一章一章地调。

一条光带从暖琥珀色过渡到冷银色

配音替换与转写

不用重录就能替换已录好的表演,任何片段都能转成标注说话人的文字稿。

提示词示例

配音

温暖的纪录片旁白:「潮水从未迟到过。」

0:00
0:12
Edit prompt

带人声的歌曲

慢速独立民谣,刷鼓,一个贴近的女声唱我的词。

0:00
0:12
Edit prompt

音效设计

沉重的橡木门在石地上拖开,铰链嘎吱作响。8秒。

0:00
0:12
Edit prompt

环境声

深夜:蟋蟀细响,远处一声狗吠,一辆车驶过。20秒。

0:00
0:12
Edit prompt

双人对话

安(平淡):「你说的是九点。」西奥(急):「桥封了,我跑来的。」

0:00
0:12
Edit prompt

角色朗读

灯塔看守,沙哑而深情:「四十个冬天,这盏灯。」

0:00
0:12
Edit prompt

概览

Morphic的声音这一端,从头到尾都由ElevenLabs撑着。六种模式跑在它上面:语音、音乐、音效、对话、变声器,以及Scribe转写。范围广本身就是重点。一条片子通常要一个旁白、一层音乐、几个音效,有时还要第二个角色,而这四样都出自同一处,和素材待在同一个项目里。

真正把它和普通的文字转语音拉开距离的,是那几个控制项。稳定度、风格、相似度和语速,让一次生成从抽签变成一次调度。音乐会拿您的歌词唱出来。音效可以指定长度,一记撞击就落在它本该落的那一帧上。至于语音转语音,意味着您早就录好的一条表演,可以换一种声音,而不丢掉当初捕捉到的那份劲儿。

简单定价

今天就免费开始,随时可以升级或取消。

Basic

$9/
账单金额为 $0 每年

1100 每月 信用

1 个用户

所有模型

工作流

Standard

$24/
账单金额为 $0 每年

3625 每月 信用

1 个用户

所有模型

工作流

Pro

$45/
账单金额为 $0 每年

6350 共享 每月 信用

1 用户

+ 最多 4 人额外付费可增加

所有模型

工作流

Pro Max

$170/
账单金额为 $0 每年

24650 共享 每月 信用

1 用户

+ 最多 9 人额外付费可增加

所有模型

工作流

Enterprise

更高的限制

自定义

定价和账单条款

大容量信用
自定义席位限制
所有模型
工作流
Pricing Gradient

Free

供随意体验

$0

永久免费

最多 20 积分
仅1个用户
部分模型
工作流

常见问题

Morphic上的ElevenLabs是什么?
Morphic有六种音频模式跑在ElevenLabs上:文字转语音、文字转音乐、文字转音效、文字转对话、语音转语音(也就是变声器),以及Scribe转写。音频和您的图像、视频在同一个工作区里生成,不必导出再导回。
ElevenLabs能生成哪些类型的音频?
口播旁白与配音、可纯器乐也可演唱的原创音乐、音效与环境声、多说话人的对话场景,以及把一段已有录音换成另一种声音的版本。Scribe则反过来走,把音频或视频转成带说话人标注的文字稿。
能控制ElevenLabs的声音怎么念一句话吗?
可以。每次文字转语音生成都提供稳定度、风格、相似度和语速四个控制项。稳定度在一致性和表现力之间取舍,风格让语气离中性更远,相似度决定输出贴合所选声音的程度,语速调整节奏。对话生成另有自己的稳定度控制。
ElevenLabs的音乐能带歌词和人声吗?
能。音乐工具有一个人声开关和一个歌词框。粘贴自己写的词,模型就唱出来;留空则由它替您写。曲目时长从五秒到五分钟,所以同一个工具既能做几秒的转场音,也能做一首完整的歌。
ElevenLabs的变声器是做什么的?
语音转语音会把一段录音用另一种声音重新演绎,同时保留原来的表演方式、节奏和情绪。每次转换最多接受五分钟源音频,英语和多语种输入都支持。它做的是语音转换,不会生成某个人声音的可复用副本。
ElevenLabs生成的音频能有多长?
音乐从五秒到五分钟。音效从半秒到二十二秒。语音不按时钟计,而是受提示词长度限制,每次生成最多3,000字符,对话脚本可以写到5,000字符。更长的内容分多次生成再拼接。
ElevenLabs音频怎么和Morphic上的AI视频配合?
先用ElevenLabs做好旁白、配乐和音效,再把它们带进Canvas,和Morphic上任意视频模型出的片段放在一起。声音和画面在同一个项目里,一条剪辑不用离开工作区就能配好乐、配好旁白。