ElevenLabs
por ElevenLabs
Seis modos de áudio em um só lugar.
Voz, música, sound design, diálogo e conversão de voz.

Principais recursos
Ouça a variedade
Uma leitura quente e sem pressa, em ritmo de documentário.
Letra escrita por você, cantada como um folk indie.
Grilos, um cachorro ao longe, um carro passando.
Dois falantes, vozes distintas, uma geração.
Especificações técnicas
6
Fala, música, efeitos, diálogo, conversão, transcrição
3.000 caract.
Por geração de texto para fala
de 5s a 5min
Instrumental, ou cantada a partir da sua letra
de 0,5 a 22s
Por efeito gerado
5.000 caract.
Todos os falantes numa única passada
Até 5 min
De áudio de origem por conversão
Casos de uso

Narração e locução
Narre imagens geradas por IA ou filmagem real, escolhendo a voz por gênero, idade, sotaque e uso, sem rolar uma lista.

Músicas e trilha original
Componha uma base instrumental para o vídeo, ou escreva a letra e receba a música pronta, cantada no estilo que pediu.

Sound design e ambiência
Monte foley, ruído de sala e camadas de clima sem licenciar nada, com a duração exata que cada momento pede.

Podcasts e audiodrama
Produza vinhetas, blocos de narração e cenas inteiras com vários falantes, cada personagem com voz e entrega próprias.

Narração de audiolivros
Leitura longa com ritmo e tom constantes entre capítulos, gerada em passadas que você dirige capítulo a capítulo.

Dublagem e transcrição
Troque a voz de uma gravação sem regravar, e transforme qualquer clipe em transcrição que marca quem fala.
Exemplos de prompts
Música com vocal
Folk indie lento, bateria com vassourinhas, voz feminina cantando minha letra.
Sound design
Porta pesada de carvalho arrastando na pedra, dobradiças rangendo. 8 segundos.
Ambiência
Fim de noite: grilos vibrando, um cachorro distante, um carro ao longe. 20s.
Diálogo de dois
Ana (seca): 'Você disse nove.' Theo (rápido): 'A ponte fechou, eu corri.'
Leitura de personagem
Faroleiro, voz rouca e afetuosa: 'Quarenta invernos, esta luz.'
Visão geral
O ElevenLabs cobre todo o lado de áudio do Morphic, de ponta a ponta. Seis modos rodam sobre ele: fala, música, efeitos sonoros, diálogo, conversão de voz e transcrição com o Scribe. Essa amplitude é o ponto. Um corte costuma pedir narrador, uma base musical, alguns efeitos e às vezes um segundo personagem. Tudo isso sai do mesmo lugar, no mesmo projeto das imagens.
Os controles são o que separa isso de um texto para fala comum. Estabilidade, estilo, semelhança e velocidade transformam a geração em direção, e não em sorteio. A música pega a sua letra e canta. Os efeitos aceitam uma duração, então a batida cai no quadro para o qual foi escrita. E a conversão de voz coloca outra voz numa gravação que você já tem, sem perder a interpretação capturada.
Preços simples
Comece grátis hoje mesmo, com a opção de fazer upgrade ou cancelar quando quiser.
Basic
1100 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Standard
3625 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Pro
6350 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Pro Max
24650 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Enterprise
Para limites maiores
Personalizado
termos de preços e cobrança

Free
Para experimentar
$0
grátis para sempre
Perguntas frequentes
Outros modelos
Explore o restante do catálogo de modelos do Morphic.
ChatGPT Images 2.5
OpenAI
Detalhe mais nítido e edição que não bagunça o resto do quadro. O modelo de imagem da OpenAI, de setembro de 2026.
Lyria 3.5
Google DeepMind
O melhor modelo de música do Google. Músicas inteiras, com voz e letra.
MiniMax H3 Max Turbo
fal.ai
O nível rápido do H3 da fal. O dobro da velocidade, quase igual.
Inworld TTS 2
Inworld
Noventa e cinco vozes, 100+ idiomas. A fala começa em menos de um segundo.