MiniMax H3 Max Turbo
par fal.ai
Le palier rapide du H3 signé fal.
Deux fois plus vite, rendu quasi égal.

Fonctionnalités clés
Spécifications techniques
MiniMax H3
Distillé par fal à partir de son propre H3 Max
2 modes
Texte vers vidéo et image vers vidéo, tous deux actifs
5 à 15 s
Cinq à dix secondes, la plage recommandée
Jusqu’à 768p
480p et 768p natifs, un cran au-dessus du 720p HD
24 FPS
La cadence à laquelle on tourne au cinéma et à la télévision
Natif
Un son stéréo produit en même temps que l’image
11 langues
Hérité de H3, stable sur 11 langues
6 formats
21:9, 16:9, 4:3, 1:1, 3:4 et 9:16 pris en charge
Cas d'utilisation
Un dispositif, plusieurs partis pris
Relumez et recadrez la même scène dans une seule prise. Un choix de lumière se juge alors en mouvement, pas sur une image arrêtée.
Prévisualisation et animatique
Vous découpez le plan, vous le regardez, vous corrigez, vous regardez encore. La boucle est assez courte pour tester une piste incertaine.
Génération interactive
Tout ce qui suppose quelqu’un qui attend le résultat : un bouton de génération dans un produit, une boucle de chat, une démo en direct.
Catalogue et déclinaisons par référence
Le débit décide si toute une gamme est traitable, ou seulement les vingt meilleures ventes.
Scènes menées par le son
Comme le son est prédit avec l’image, une scène construite sur un bruit précis arrive déjà sonorisée.
Titres et typographie animée
Citez les mots exacts, ils reviennent correctement orthographiés. Un carton-titre part donc tel qu’il a été généré.
Exemples de prompts
Vue d’ensemble
MiniMax H3 Max Turbo est le palier vitesse de H3 Max, construit par fal. Le parcours tient en trois étapes. MiniMax a ouvert les poids de H3 en août 2026. fal les a post-entraînés en H3 Max, pour gagner en fidélité au brief et en qualité de rendu. Puis fal a distillé H3 Max une seconde fois, cette fois pour le débit.
Turbo est cette troisième étape, sortie en préversion en septembre 2026. Ce qui revient : un clip de 5 à 15 secondes, jusqu’en 768p, à 24 images par seconde, avec un son stéréo produit en même temps que l’image.
L’annonce, et ce sur quoi elle repose
fal donne Turbo deux fois plus rapide que H3 Max, en visant le 97e centile de sa qualité sur ses propres évaluations. La maison ajoute qu’il se situe toujours au-dessus du MiniMax H3 de base dont il descend. C’est cette dernière précision qui mérite l’attention. Un palier rapide se place d’ordinaire sous le modèle qu’il allège. Ici, le plancher est tombé entre les deux : sous H3 Max, au-dessus de H3.
Le chiffre à retenir n’est pas le multiplicateur, mais le seuil qu’il fait franchir. H3 Max rendait déjà un clip de cinq secondes en moins de trois secondes. En doublant cette cadence, une génération de quinze secondes tient largement dans quinze secondes d’attente. Autrement dit, le rendu se termine avant que le clip n’ait eu le temps de se jouer. La vidéo générée cesse d’être une chose que l’on attend.
Ce que la vitesse change
À trente secondes la génération, vous lancez un rendu et vous partez ailleurs. À une seconde et demie, on est plus près de la frappe au clavier. Vingt variantes d’une accroche publicitaire se jugent alors comme du mouvement fini, et non comme un storyboard. Un plan se découpe, se regarde, se corrige et se regarde encore dans la même séance.
En agence, cela se mesure en allers-retours. La piste à laquelle une seule personne croit ne demande plus d’être défendue en réunion, puisqu’elle coûte quelques secondes. Un retour client se traite pendant la réunion, pas le lendemain matin.
Une catégorie entière s’ouvre aussi, que trente secondes de latence fermaient : tout ce qui suppose quelqu’un à l’autre bout. Un bouton de génération dans un produit, une boucle pilotée par le chat, une démo jouée devant une salle. Aucun de ces usages ne supporte un compteur qui tourne pendant plusieurs minutes.
Quand ce n’est pas le bon choix
Deux cas, faciles à nommer. Le premier : la génération par références. Ce mode tient un personnage ou un style d’un plan à l’autre, à partir d’images, de clips et d’audio fournis. Turbo ne la propose pas. Elle appartient à H3 Max.
Le second : le plafond de 768p, qui est hérité et non choisi. H3 se livre en trois parties. Un préprocesseur interprète le brief. Un modèle de base rend en 768p. Un troisième étage régénère le tout en 2K, en reprenant le brief d’origine. Le détail fin et les petits textes sont donc retrouvés, et non devinés. MiniMax n’a ouvert que la partie centrale. Rien de ce qui dérive de ces poids ne dispose donc d’un étage 2K derrière lui.
L’attelage devient dès lors évident, plutôt qu’astucieux. On explore sur Turbo, on finit sur H3 de base. Les deux viennent des mêmes poids, si bien que le rendu se retrouve au passage de relais. Rien de tel quand on maquette chez un éditeur pour finir chez un autre.
MiniMax H3 Max Turbo sur Morphic
Dans le sélecteur de modèles vidéo, MiniMax H3 Max Turbo voisine avec MiniMax H3 Max, MiniMax H3, Seedance, Kling et Veo. Écrivez le plan comme un brief, générez, et la prise se dépose sur le Canvas. De là, le même brief part sur un autre modèle et les deux se comparent côte à côte.
Deux habitudes paient particulièrement avec ce modèle, et elles valent pour tous les autres du sélecteur. Écrivez l’action sur toute la durée du clip, plutôt que de décrire une image. Et dirigez le son avec la même attention que le cadre.
Tarifs simples
Commencez gratuitement dès aujourd'hui, avec la possibilité de mettre à niveau ou d'annuler à tout moment.
Basic
1100 mensuel crédits
1 utilisateur uniquement
Tous les modèles
Workflows
Standard
3625 mensuel crédits
1 utilisateur uniquement
Tous les modèles
Workflows
Pro
6350 partagé mensuel crédits
1 utilisateur
Tous les modèles
Workflows
Pro Max
24650 partagé mensuel crédits
1 utilisateur
Tous les modèles
Workflows
Enterprise
Pour des limites plus élevées
Personnalisé
conditions de tarification et de facturation

Free
Pour expérimenter
$0
gratuit pour toujours
Questions fréquentes
ChatGPT Images 2.5
OpenAI
Le modèle d'image d'OpenAI, sorti en septembre 2026. Plus de détail, des retouches ciblées, plus de vitesse.
Lyria 3.5
Google DeepMind
Le meilleur modèle musical de Google. Des chansons entières, voix et paroles.
Inworld TTS 2
Inworld
95 voix, plus de 100 langues. La voix part en moins d’une seconde.
Gemini Omni Flash 1.1
Google DeepMind
Le modèle vidéo de Google où la retouche s’écrit. Désormais en 4K et jusqu’à 40 secondes.