MiniMax H3 Max
par fal.ai
MiniMax H3, post‑entraîné par fal.
Plus fidèle au brief, reconstruit pour la vitesse.

Fonctionnalités clés
Spécifications techniques
MiniMax H3
Post-entraîné par fal à partir des poids ouverts de H3
2 modes
Texte vers vidéo et image vers vidéo, tous deux actifs
5 à 15 s
Cinq à dix secondes, la plage recommandée
Jusqu'à 768p
480p et 768p natifs, un cran au-dessus du 720p HD
24 FPS
La cadence à laquelle on tourne au cinéma et à la télévision
Natif
Un son stéréo produit en même temps que l'image
11 langues
Hérité de H3, stable sur 11 langues
6 formats
21:9, 16:9, 4:3, 1:1, 3:4 et 9:16 pris en charge
Cas d'utilisation
Typographie cinétique
Un tracé dessiné se résout en lettres lisibles et tient. Le texte reste correctement orthographié, en latin comme en japonais.
Volumes 3D isométriques
Les dalles montent, les tours s'étirent, les chemins se rejoignent : une visite produit se construit à l'écran.
Schémas techniques
Des tracés qui se construisent seuls : un plan bascule en isométrie, puis les cotes et les annotations apparaissent.
Collage et découpe
Des fragments aux bords déchirés et des trames imprimées glissent et se calent sur le sujet. L'effet reste artisanal.
Rendu riso et imprimé
Encre deux tons, trame grossière et décalage assumé, comme celui que laisse un second passage sous presse.
Scènes menées par le son
L'image et le son naissent ensemble : une scène bâtie autour d'un bruit précis arrive déjà avec ce bruit.
Exemples de prompts
Vue d'ensemble
Deux modèles portent presque le même nom, et l'arbitrage entre eux se règle en une phrase. H3 vise la résolution. H3 Max vise la vitesse.
Reste à savoir d'où vient H3 Max, parce que le nom ne le dit pas. MiniMax a ouvert les poids de H3 en août 2026. fal les a réentraînés sur ses propres données, puis a branché sa propre pile d'inférence derrière.
Le résultat tient en quelques chiffres. De 5 à 15 secondes, jusqu'en 768p, à 24 images par seconde. Le son stéréo sort avec l'image, pas après elle.
Pourquoi le nom prête à confusion
Max sonne comme un palier de qualité. Ailleurs, ce palier s'appelle Pro.
Ici, rien de tel. Un tiers a réglé un modèle ouvert, et c'est tout. Ni un H3 plus gros, ni un H3 plus fin, ni quoi que ce soit sorti par MiniMax.
D'où la spécification qui surprend presque tout le monde. Le plafond de résolution est plus bas que celui du modèle d'origine. Pas plus haut.
D'où vient ce plafond
H3 se livre en trois parties.
Un préprocesseur lit le brief et le réécrit sous forme structurée. Un modèle de base rend cela à 768 pixels sur le petit côté. Un troisième module régénère le tout en 2K, en reprenant le brief d'origine pour que le détail fin et les petits textes soient retrouvés plutôt que devinés.
MiniMax n'a ouvert que la partie centrale.
Une variante post-entraînée hérite donc d'un générateur 768p natif, et de rien derrière. Voilà l'arbitrage : pas de finition haute résolution, tout sur la rapidité.
Ce que la vitesse change
À trente secondes la génération, vous lancez un rendu et vous passez à autre chose. À trois secondes, vous restez dessus. C'est ce basculement qui compte, plus que le chiffre.
En agence, cela se traduit très concrètement. Vingt accroches publicitaires se jugent comme du mouvement fini, pas comme un storyboard. Un aller-retour avec le client se termine pendant la réunion, et non le lendemain matin. Et la piste à laquelle une seule personne croit ne demande plus d'être défendue en réunion : elle coûte trois secondes.
La résolution plus basse en est le prix, et il est assumé. Pour un fil social, une formation, un montage interne ou un jet intermédiaire, 768p suffit. Pour un master, non. Là, on retourne vers H3.
MiniMax H3 Max sur Morphic
Dans le sélecteur de modèles vidéo, H3 Max voisine avec MiniMax H3, Seedance, Kling et Veo.
Écrivez le plan comme un brief, générez, et la prise se dépose sur le Canvas. De là, le même brief part sur un second modèle et les deux prises se comparent côte à côte. Le réflexe est familier en agence : on met deux pistes en concurrence avant d'en valider une.
Deux habitudes paient particulièrement avec ce modèle, et elles valent pour tous les autres. Écrivez l'action sur toute la durée du clip plutôt que de décrire une image. Et dirigez le son avec la même attention que le cadre.
Tarifs simples
Commencez gratuitement dès aujourd'hui, avec la possibilité de mettre à niveau ou d'annuler à tout moment.
Basic
1100 mensuel crédits
1 utilisateur uniquement
Tous les modèles
Workflows
Standard
3625 mensuel crédits
1 utilisateur uniquement
Tous les modèles
Workflows
Pro
6350 partagé mensuel crédits
1 utilisateur
Tous les modèles
Workflows
Pro Max
24650 partagé mensuel crédits
1 utilisateur
Tous les modèles
Workflows
Enterprise
Pour des limites plus élevées
Personnalisé
conditions de tarification et de facturation

Free
Pour expérimenter
$0
gratuit pour toujours
Questions fréquentes
ChatGPT Images 2.5
OpenAI
Le modèle d'image d'OpenAI, sorti en septembre 2026. Plus de détail, des retouches ciblées, plus de vitesse.
Lyria 3.5
Google DeepMind
Le meilleur modèle musical de Google. Des chansons entières, voix et paroles.
MiniMax H3 Max Turbo
fal.ai
Le palier rapide du H3 signé fal. Deux fois plus vite, rendu quasi égal.
Inworld TTS 2
Inworld
95 voix, plus de 100 langues. La voix part en moins d’une seconde.