Geração de áudio
Disponível agora

ElevenLabs

por ElevenLabs

Seis modos de áudio em um só lugar.
Voz, música, sound design, diálogo e conversão de voz.

ElevenLabs

Principais recursos

Ouça a variedade

Narração de documentárioFala

Uma leitura quente e sem pressa, em ritmo de documentário.

0:00
0:12
Música com vocal cantadoMúsica

Letra escrita por você, cantada como um folk indie.

0:00
0:12
Ambiência de fim de noiteEfeitos sonoros

Grilos, um cachorro ao longe, um carro passando.

0:00
0:12
Cena de dois personagensDiálogo

Dois falantes, vozes distintas, uma geração.

0:00
0:12

Especificações técnicas

6

Fala, música, efeitos, diálogo, conversão, transcrição

3.000 caract.

Por geração de texto para fala

de 5s a 5min

Instrumental, ou cantada a partir da sua letra

de 0,5 a 22s

Por efeito gerado

5.000 caract.

Todos os falantes numa única passada

Até 5 min

De áudio de origem por conversão

Casos de uso

Uma faixa de luz que incha e afina como uma onda sonora falada

Narração e locução

Narre imagens geradas por IA ou filmagem real, escolhendo a voz por gênero, idade, sotaque e uso, sem rolar uma lista.

Arcos concêntricos de luz dourada se expandindo como um acorde tocado

Músicas e trilha original

Componha uma base instrumental para o vídeo, ou escreva a letra e receba a música pronta, cantada no estilo que pediu.

Filamentos luminosos irradiando de um único impacto brilhante

Sound design e ambiência

Monte foley, ruído de sala e camadas de clima sem licenciar nada, com a duração exata que cada momento pede.

Duas fitas de luz, uma âmbar e uma ardósia, se trançando

Podcasts e audiodrama

Produza vinhetas, blocos de narração e cenas inteiras com vários falantes, cada personagem com voz e entrega próprias.

Um único fio de luz quente recuando ao longe na escuridão

Narração de audiolivros

Leitura longa com ritmo e tom constantes entre capítulos, gerada em passadas que você dirige capítulo a capítulo.

Uma fita de luz passando do âmbar quente ao prata frio

Dublagem e transcrição

Troque a voz de uma gravação sem regravar, e transforme qualquer clipe em transcrição que marca quem fala.

Exemplos de prompts

Locução

Narrador de documentário, voz quente: 'A maré nunca se atrasou.'

0:00
0:12
Edit prompt

Música com vocal

Folk indie lento, bateria com vassourinhas, voz feminina cantando minha letra.

0:00
0:12
Edit prompt

Sound design

Porta pesada de carvalho arrastando na pedra, dobradiças rangendo. 8 segundos.

0:00
0:12
Edit prompt

Ambiência

Fim de noite: grilos vibrando, um cachorro distante, um carro ao longe. 20s.

0:00
0:12
Edit prompt

Diálogo de dois

Ana (seca): 'Você disse nove.' Theo (rápido): 'A ponte fechou, eu corri.'

0:00
0:12
Edit prompt

Leitura de personagem

Faroleiro, voz rouca e afetuosa: 'Quarenta invernos, esta luz.'

0:00
0:12
Edit prompt

Visão geral

O ElevenLabs cobre todo o lado de áudio do Morphic, de ponta a ponta. Seis modos rodam sobre ele: fala, música, efeitos sonoros, diálogo, conversão de voz e transcrição com o Scribe. Essa amplitude é o ponto. Um corte costuma pedir narrador, uma base musical, alguns efeitos e às vezes um segundo personagem. Tudo isso sai do mesmo lugar, no mesmo projeto das imagens.

Os controles são o que separa isso de um texto para fala comum. Estabilidade, estilo, semelhança e velocidade transformam a geração em direção, e não em sorteio. A música pega a sua letra e canta. Os efeitos aceitam uma duração, então a batida cai no quadro para o qual foi escrita. E a conversão de voz coloca outra voz numa gravação que você já tem, sem perder a interpretação capturada.

Preços simples

Comece grátis hoje mesmo, com a opção de fazer upgrade ou cancelar quando quiser.

Basic

$9/ mês
cobrado como $0 por ano

1100 mensal créditos

1 apenas usuário

Todos os modelos

Workflows

Standard

$24/ mês
cobrado como $0 por ano

3625 mensal créditos

1 apenas usuário

Todos os modelos

Workflows

Pro

$45/ mês
cobrado como $0 por ano

6350 compartilhado mensal créditos

1 usuário

+ até 4 mais com custo adicional

Todos os modelos

Workflows

Pro Max

$170/ mês
cobrado como $0 por ano

24650 compartilhado mensal créditos

1 usuário

+ até 9 mais com custo adicional

Todos os modelos

Workflows

Enterprise

Para limites maiores

Personalizado

termos de preços e cobrança

Créditos de alto volume
Limites de vagas personalizados
Todos os modelos
Workflows
Pricing Gradient

Free

Para experimentar

$0

grátis para sempre

Até 20 créditos
apenas 1 usuário
Modelos limitados
Workflows

Perguntas frequentes

O que é o ElevenLabs no Morphic?
O ElevenLabs é o motor de áudio por trás de seis modos de áudio do Morphic: texto para fala, texto para música, texto para efeitos sonoros, texto para diálogo, fala para fala (a conversão de voz) e transcrição com o Scribe. Você gera áudio no mesmo espaço de trabalho das suas imagens e dos seus vídeos, sem precisar exportar e reimportar nada.
Que tipos de áudio o ElevenLabs gera?
Narração e locução, música original instrumental ou cantada, efeitos sonoros e ambiência, cenas de diálogo com vários falantes e uma versão convertida de uma gravação que você já tem. O Scribe faz o caminho inverso: transforma áudio ou vídeo em transcrição com marcação de quem está falando.
Dá para controlar como a voz do ElevenLabs interpreta uma fala?
Sim. Cada geração de texto para fala expõe estabilidade, estilo, semelhança e velocidade. A estabilidade equilibra consistência e expressividade, o estilo afasta a entrega do neutro, a semelhança define o quanto a saída acompanha a voz escolhida e a velocidade ajusta o ritmo. As gerações de diálogo trazem um controle de estabilidade próprio.
A música do ElevenLabs pode ter letra e vocal?
Sim. A ferramenta de música tem um botão de vocal e um campo de letra. Cole a sua letra e o modelo canta, ou deixe o campo vazio e ele escreve por você. As faixas vão de cinco segundos a cinco minutos, então a mesma ferramenta cobre uma vinheta curta e uma música inteira.
O que faz a conversão de voz do ElevenLabs?
Fala para fala pega uma gravação e a reinterpreta em outra voz, mantendo a entrega, o ritmo e a emoção originais. Aceita até cinco minutos de áudio de origem por conversão e funciona com entrada em inglês e multilíngue. É conversão de voz: não cria uma cópia reutilizável da voz de uma pessoa específica.
Qual a duração máxima do áudio do ElevenLabs?
A música vai de cinco segundos a cinco minutos. Os efeitos sonoros vão de meio segundo a vinte e dois segundos. A fala é limitada pelo tamanho do prompt, e não pelo relógio, com até 3.000 caracteres por geração, e um roteiro de diálogo chega a 5.000 caracteres. Peças mais longas são geradas em passadas e montadas depois.
Como o áudio do ElevenLabs se junta ao vídeo com IA no Morphic?
Gere a narração, a trilha e o sound design com o ElevenLabs e leve tudo para o Canvas, ao lado de clipes de qualquer modelo de vídeo do Morphic. Áudio e imagem ficam no mesmo projeto, então dá para trilhar e narrar um corte sem sair do espaço de trabalho.