Generación de audio
Disponible ahora

ElevenLabs

de ElevenLabs

Seis modos de audio en un solo lugar.
Voz, música, diseño sonoro, diálogo y cambiador de voz.

ElevenLabs

Funciones clave

Escucha el rango

Narración documentalVoz

Una lectura cálida y pausada, a ritmo de documental.

0:00
0:12
Canción con voz cantadaMúsica

Letra escrita, devuelta cantada como folk indie.

0:00
0:12
Ambiente nocturnoEfectos de sonido

Grillos, un perro a lo lejos, un auto que pasa.

0:00
0:12
Escena a dos vocesDiálogo

Dos hablantes, voces distintas, una sola generación.

0:00
0:12

Especificaciones técnicas

6

Voz, música, efectos, diálogo, cambiador y transcripción

3,000 signos

Por generación de texto a voz

de 5s a 5min

Instrumental o cantada a partir de tu letra

de 0.5 a 22s

Por efecto generado

5,000 signos

Todas las voces en una sola pasada

Hasta 5 min

De audio original por conversión

Casos de uso

Una cinta de luz que se ensancha y adelgaza como una onda de voz

Narración y voz en off

Narra material generado con IA o filmado, y elige la voz por género, edad, acento y uso en vez de recorrer una lista.

Arcos concéntricos de luz dorada que se expanden como un acorde

Canciones y banda sonora

Musicaliza un video con una base instrumental, o escribe la letra y recibe la canción cantada en el estilo que pediste.

Filamentos luminosos que irradian desde un único impacto brillante

Diseño sonoro y ambientes

Arma foley, ambiente de sala y climas para un corte sin licenciar nada, con la duración exacta que pide cada momento.

Dos cintas de luz, una ámbar y otra gris pizarra, trenzándose

Pódcast y radioteatro

Produce intros, tramos de narración y escenas completas con varios personajes, cada uno con su voz y su interpretación.

Un solo hilo de luz cálida que se aleja hacia la oscuridad

Narración de audiolibros

Lecturas largas con ritmo y tono parejos entre capítulos, generadas en pasadas que diriges capítulo por capítulo.

Una cinta de luz que pasa del ámbar cálido al plateado frío

Doblaje y transcripciones

Cambia la voz de una toma grabada sin regrabarla, y convierte cualquier clip en un texto que marca quién habla.

Ejemplos de prompts

Voz en off

Narrador documental cálido: “La marea nunca ha llegado tarde”.

0:00
0:12
Edit prompt

Canción con voz

Folk indie lento, escobillas, una voz femenina cercana canta mi letra.

0:00
0:12
Edit prompt

Diseño sonoro

Un portón de roble arrastrándose sobre piedra, bisagras chirriando. 8 s.

0:00
0:12
Edit prompt

Ambiente

Noche cerrada: grillos vibrando, un perro lejano, un auto a lo lejos. 20 s.

0:00
0:12
Edit prompt

Diálogo a dos voces

Ana (seca): “Dijiste a las nueve”. Teo (rápido): “Cerraron el puente”.

0:00
0:12
Edit prompt

Voz de personaje

Farero, ronco y afectuoso: “Cuarenta inviernos con esta luz”.

0:00
0:12
Edit prompt

Overview

ElevenLabs cubre todo el lado del audio en Morphic. Seis modos corren sobre él: voz, música, efectos de sonido, diálogo, cambiador de voz y transcripción con Scribe. Ese alcance es justamente el punto. Un corte cualquiera pide un narrador, una base musical, algunos efectos y a veces un segundo personaje, y las cuatro cosas salen del mismo lugar, en el mismo proyecto que el material filmado.

Los controles son lo que lo separa de un texto a voz común. Estabilidad, estilo, parecido y velocidad convierten una generación en una dirección y no en una lotería. La música toma tu letra y la canta. Los efectos aceptan una duración, así que un golpe cae en el cuadro para el que fue escrito. Y voz a voz significa que una toma ya grabada puede llevar otra voz sin perder la interpretación que capturaste.

Precios simples

Comienza gratis hoy, con la opción de mejorar tu plan o cancelar cuando quieras.

Basic

$9/ mes
facturado como $0 por año

1100 mensual créditos

1 usuario

Todos los modelos

Workflows

Standard

$24/ mes
facturado como $0 por año

3625 mensual créditos

1 usuario

Todos los modelos

Workflows

Pro

$45/ mes
facturado como $0 por año

6350 compartidos mensual créditos

1 usuario

+ hasta 4 más con costo adicional

Todos los modelos

Workflows

Pro Max

$170/ mes
facturado como $0 por año

24650 compartidos mensual créditos

1 usuario

+ hasta 9 más con costo adicional

Todos los modelos

Workflows

Enterprise

Para límites más altos

Personalizado

términos de precios y facturación

Créditos de alto volumen
Límites de asientos personalizados
Todos los modelos
Workflows
Pricing Gradient

Free

Para experimentar

$0

gratis para siempre

Hasta 20 créditos
Solo 1 usuario
Modelos limitados
Workflows

Preguntas frecuentes

¿Qué es ElevenLabs en Morphic?
ElevenLabs es el motor de audio detrás de seis modos de Morphic: texto a voz, texto a música, texto a efectos de sonido, texto a diálogo, voz a voz (el cambiador de voz) y transcripción con Scribe. Generas el audio en el mismo espacio donde ya tienes tus imágenes y tus videos, así que no hay nada que exportar ni que volver a importar.
¿Qué tipo de audio genera ElevenLabs?
Narración y voz en off, música original instrumental o cantada, efectos de sonido y ambientes, escenas de diálogo con varios personajes, y una versión convertida de una grabación que ya tienes. Scribe trabaja en el sentido contrario: convierte audio o video en un texto que identifica a cada hablante.
¿Puedo dirigir cómo interpreta una línea una voz de ElevenLabs?
Sí. Cada generación de texto a voz expone estabilidad, estilo, parecido y velocidad. La estabilidad equilibra constancia y expresividad, el estilo aleja la interpretación de lo neutro, el parecido define qué tan fiel es la salida a la voz elegida y la velocidad ajusta el ritmo. Las generaciones de diálogo traen además su propio control de estabilidad.
¿La música de ElevenLabs puede llevar letra y voces?
Sí. La herramienta de música tiene un interruptor de voces y un campo de letra. Pega tu letra y el modelo la canta, o déjalo vacío y la escribe por ti. Las pistas van de cinco segundos a cinco minutos, así que la misma herramienta cubre un remate corto y una canción entera.
¿Qué hace el cambiador de voz de ElevenLabs?
Voz a voz toma una grabación y la vuelve a interpretar con otra voz, conservando la interpretación, el ritmo y la emoción originales. Acepta hasta cinco minutos de audio de origen por conversión y funciona con material en inglés y en varios idiomas. Es conversión de voz: no construye una copia reutilizable de la voz de una persona.
¿Cuánto puede durar el audio de ElevenLabs?
La música va de cinco segundos a cinco minutos. Los efectos de sonido, de medio segundo a veintidós segundos. La voz no depende de un reloj sino del largo del prompt, hasta 3,000 caracteres por generación, y un guion de diálogo llega a 5,000 caracteres. Las piezas más largas se generan por pasadas y se arman después.
¿Cómo se combina el audio de ElevenLabs con el video con IA en Morphic?
Genera la narración, la música y el diseño sonoro con ElevenLabs, y llévalos a Canvas junto con clips de cualquier modelo de video de Morphic. El audio y la imagen viven en el mismo proyecto, así que un corte se musicaliza y se narra sin salir del espacio de trabajo.