Happy Horse 1.0
par Alibaba
Le modèle vidéo d'Alibaba qui génère vidéo et audio synchronisé en une seule passe, avec une sync labiale native en 7 langues.
Happy Horse 1.0
par Alibaba
Fonctionnalités clés
Spécifications techniques
1080p
Sortie Full HD à 24 fps
3–15s
Par génération
5
16:9, 9:16, 1:1, 4:3, 3:4
7
Sync labiale native en 7 langues
Jusqu'à 5
Pour référence vers vidéo et édition vidéo
15B
Transformeur unifié à 40 couches
Cas d'utilisation
Scènes portées par le dialogue
Des scènes où les personnages parlent dans l'une des 7 langues avec mouvement labial synchronisé, son ambiant et minutage.
Clips musicaux et de performance
Vidéo et audio générés ensemble : le mouvement tombe sur le rythme dès la première passe, sans synchronisation manuelle.
Spots pub et campagnes
Le contrôle par références garde produit, talents et visuels de marque constants d'un plan à l'autre.
Récit avec personnages constants
Fixez les personnages avec des images de référence et reportez-les sur plusieurs scènes pour un travail vidéo narratif.
Localisation de contenu multilingue
Même scène, mêmes personnages, dialogue changé d'une langue à l'autre avec sync labiale native, adapté aux campagnes mondiales.
Édition vidéo sans tout recalculer
Ajustez des détails, échangez des éléments ou restylisez des images existantes par instructions textuelles plutôt que de repartir de zéro.
Exemples de prompts
Scène de dialogue
Deux amis riant dans un café parisien, dialogue en français, caméra à l'épaule
Edit promptClip de performance
Violoncelliste sur un toit au coucher du soleil, partition orchestrale ample
Edit promptAperçu
Happy Horse 1.0 est le modèle vidéo d'Alibaba issu du Taotian Future Life Lab, sorti en avril 2026. Au lancement, il détenait le n°1 à l'Elo de l'Artificial Analysis Video Arena dans les catégories Texte vers vidéo et Image vers vidéo. Il génère vidéo et audio conjointement en une seule passe avant à travers un transformeur unifié de 15 milliards de paramètres, produisant des clips 1080p de 3 à 15 secondes avec une sync labiale native en sept langues. Le contrôle par références sur les entrées texte, image et vidéo le rend adapté aux scènes de dialogue, aux clips de performance et au récit avec personnages constants.
Tarifs simples
Commencez gratuitement dès aujourd'hui, avec la possibilité de mettre à niveau ou d'annuler à tout moment.
Basic
1100 mensuel crédits
1 utilisateur uniquement
Tous les modèles
Workflows
Standard
3625 mensuel crédits
1 utilisateur uniquement
Tous les modèles
Workflows
Pro
6350 partagé mensuel crédits
1 utilisateur
Tous les modèles
Workflows
Pro Max
24650 partagé mensuel crédits
1 utilisateur
Tous les modèles
Workflows
Enterprise
Pour des limites plus élevées
Personnalisé
conditions de tarification et de facturation

Free
Pour expérimenter
$0
gratuit pour toujours
Questions fréquentes
Autres modèles
Explorez le reste du catalogue de modèles Morphic.
ChatGPT Images 2.5
OpenAI
Le modèle d'image d'OpenAI, sorti en septembre 2026. Plus de détail, des retouches ciblées, plus de vitesse.
Lyria 3.5
Google DeepMind
Le meilleur modèle musical de Google. Des chansons entières, voix et paroles.
MiniMax H3 Max Turbo
fal.ai
Le palier rapide du H3 signé fal. Deux fois plus vite, rendu quasi égal.
Inworld TTS 2
Inworld
95 voix, plus de 100 langues. La voix part en moins d’une seconde.