Génération audio
Disponible maintenant

ElevenLabs

par ElevenLabs

Six modes audio au même endroit.
Voix, musique, bruitages, dialogue et conversion de voix.

ElevenLabs

Fonctionnalités clés

Écoutez l'éventail

Narration documentaireParole

Une lecture chaleureuse et posée, au rythme du documentaire.

0:00
0:12
Chanson avec voix chantéeMusique

Des paroles écrites, rendues en morceau folk indie.

0:00
0:12
Ambiance du soirBruitages

Des grillons, un chien au loin, une voiture qui passe.

0:00
0:12
Scène à deux voixDialogue

Deux locuteurs, deux voix distinctes, une seule génération.

0:00
0:12

Spécifications techniques

6

Voix, musique, bruitages, dialogue, conversion, transcription

3 000 signes

Par génération de synthèse vocale

5 s–5 min

Instrumentale, ou chantée sur vos paroles

0,5–22 s

Par effet généré

5 000 signes

Tous les personnages en une seule passe

Jusqu’à 5 min

Audio source par conversion

Cas d'utilisation

Un ruban de lumière qui enfle et se resserre comme une onde vocale

Narration et voix off

Narrez des images générées par IA ou tournées, en choisissant la voix par genre, âge, accent et usage plutôt que dans une liste.

Des arcs de lumière dorée qui s’écartent comme un accord frappé

Chansons et musique de film

Habillez une vidéo d’un fond instrumental, ou écrivez les paroles et récupérez une chanson chantée dans le style demandé.

Des filaments lumineux qui rayonnent depuis un unique impact clair

Design sonore et ambiances

Composez bruitages, son de salle et nappes météo pour un montage, sans licence à acheter, à la durée exacte de chaque moment.

Deux rubans de lumière, l’un ambré, l’autre ardoise, qui se tressent

Podcasts et fiction sonore

Produisez intros, segments narrés et scènes complètes à plusieurs voix, chaque personnage avec sa voix et son jeu propres.

Un seul fil de lumière chaude qui s’éloigne loin dans le noir

Narration de livres audio

Lecture longue au rythme et au ton constants d’un chapitre à l’autre, générée par passes que vous dirigez une à une.

Un ruban de lumière qui passe de l’ambre chaud à l’argent froid

Doublage et transcription

Redonnez une autre voix à une prise enregistrée, et transformez n’importe quel extrait en transcription qui indique qui parle.

Exemples de prompts

Voix off

Narrateur documentaire chaleureux : « La marée n’a jamais été en retard. »

0:00
0:12
Edit prompt

Chanson chantée

Folk indie lent, balais sur la caisse, une voix féminine proche chante.

0:00
0:12
Edit prompt

Design sonore

Une lourde porte en chêne raclant la pierre, gonds grinçants. 8 secondes.

0:00
0:12
Edit prompt

Ambiance

Fin de soirée : grillons, un chien lointain, une voiture au loin. 20 s.

0:00
0:12
Edit prompt

Dialogue à deux

Ana (plate) : « Tu avais dit neuf heures. » Théo (vite) : « J’ai couru. »

0:00
0:12
Edit prompt

Voix de personnage

Gardien de phare, rocailleux et tendre : « Quarante hivers, ce feu. »

0:00
0:12
Edit prompt

Vue d’ensemble

ElevenLabs prend en charge tout le versant audio de Morphic. Six modes tournent dessus : la parole, la musique, les bruitages, le dialogue, le convertisseur de voix et la transcription Scribe. Cette amplitude est justement l’intérêt. Un montage réclame en général un narrateur, un lit musical, quelques effets et parfois un second personnage, et ces quatre briques arrivent du même endroit, dans le projet où se trouvent déjà les images.

Ce sont les réglages qui le distinguent d’une synthèse vocale ordinaire. Stabilité, style, ressemblance et vitesse font d’une génération une direction d’acteur plutôt qu’un tirage au sort. La musique reprend vos paroles et les chante. Les bruitages acceptent une durée, donc un impact tombe sur l’image pour laquelle il a été écrit. Et la conversion voix vers voix permet à une prise déjà enregistrée de porter une autre voix sans perdre le jeu que vous aviez capté.

Tarifs simples

Commencez gratuitement dès aujourd'hui, avec la possibilité de mettre à niveau ou d'annuler à tout moment.

Basic

$9/ mois
facturé comme $0 par an

1100 mensuel crédits

1 utilisateur uniquement

Tous les modèles

Workflows

Standard

$24/ mois
facturé comme $0 par an

3625 mensuel crédits

1 utilisateur uniquement

Tous les modèles

Workflows

Pro

$45/ mois
facturé comme $0 par an

6350 partagé mensuel crédits

1 utilisateur

+ jusqu'à 4 plus à un coût supplémentaire

Tous les modèles

Workflows

Pro Max

$170/ mois
facturé comme $0 par an

24650 partagé mensuel crédits

1 utilisateur

+ jusqu'à 9 plus à un coût supplémentaire

Tous les modèles

Workflows

Enterprise

Pour des limites plus élevées

Personnalisé

conditions de tarification et de facturation

Crédits à haut volume
Limites de sièges personnalisées
Tous les modèles
Workflows
Pricing Gradient

Free

Pour expérimenter

$0

gratuit pour toujours

Jusqu'à 20 crédits
1 utilisateur uniquement
Modèles limités
Workflows

Questions fréquentes

Qu’est-ce qu’ElevenLabs sur Morphic ?
ElevenLabs fait tourner six des modes audio de Morphic : synthèse vocale, texte vers musique, texte vers bruitages, texte vers dialogue, voix vers voix (le convertisseur) et la transcription Scribe. L’audio se génère dans l’espace de travail où vivent déjà vos images et vos vidéos, sans passer par un export puis un réimport.
Quels types d’audio ElevenLabs peut-il produire ?
De la narration et de la voix off, de la musique originale instrumentale ou chantée, des bruitages et des ambiances, des scènes de dialogue à plusieurs voix, ainsi qu’une version convertie d’un enregistrement que vous possédez déjà. Scribe fonctionne dans l’autre sens : il transforme un audio ou une vidéo en transcription qui indique qui parle.
Puis-je diriger la façon dont une voix ElevenLabs interprète une réplique ?
Oui. Chaque génération de synthèse vocale expose la stabilité, le style, la ressemblance et la vitesse. La stabilité arbitre entre régularité et expressivité, le style éloigne l’interprétation du neutre, la ressemblance fixe la fidélité à la voix choisie et la vitesse ajuste le débit. Les générations de dialogue disposent en plus de leur propre réglage de stabilité.
La musique ElevenLabs peut-elle contenir des paroles et du chant ?
Oui. L’outil de musique propose un interrupteur de chant et un champ de paroles. Collez vos paroles et le modèle les chante, ou laissez le champ vide et il les écrit à votre place. Les morceaux vont de cinq secondes à cinq minutes, si bien que le même outil couvre un court jingle comme une chanson entière.
Que fait le convertisseur de voix d’ElevenLabs ?
La conversion voix vers voix reprend un enregistrement et le réinterprète avec une autre voix, en conservant l’interprétation, le rythme et l’émotion d’origine. Elle accepte jusqu’à cinq minutes d’audio source par conversion et fonctionne sur de l’anglais comme sur du multilingue. Il s’agit bien d’une conversion : aucune copie réutilisable de la voix d’une personne n’est fabriquée.
Quelle durée peut atteindre un audio ElevenLabs ?
La musique va de cinq secondes à cinq minutes. Les bruitages vont d’une demi-seconde à vingt-deux secondes. La parole est bornée par la longueur du prompt plutôt que par une horloge, jusqu’à 3 000 caractères par génération, et un script de dialogue peut monter à 5 000 caractères. Les pièces plus longues se génèrent par passes, puis s’assemblent.
Comment l’audio ElevenLabs s’articule-t-il avec la vidéo IA sur Morphic ?
Générez la narration, la musique et le design sonore avec ElevenLabs, puis amenez le tout dans Canvas à côté de plans issus de n’importe quel modèle vidéo disponible sur Morphic. L’image et le son vivent dans le même projet : un montage se met en musique et se fait narrer sans quitter l’espace de travail.