MiniMax H3 Max
von fal.ai
MiniMax H3, von fal nachtrainiert.
Genauer im Briefing, neu gebaut auf Tempo.

Hauptfunktionen
Technische Spezifikationen
MiniMax H3
Von fal aus den offenen H3-Gewichten nachtrainiert
2 Modi
Text zu Video und Bild zu Video, beide verfügbar
5 bis 15 s
Empfohlen sind fünf bis zehn Sekunden
Bis zu 768p
Nativ 480p und 768p, eine Stufe über 720p HD
24 FPS
Der Takt, in dem Kino und Fernsehen gedreht werden
Nativ
Stereoton entsteht gemeinsam mit dem Bild
11 Sprachen
Von H3 geerbt, das über 11 Sprachen stabil bleibt
6 Formate
21:9, 16:9, 4:3, 1:1, 3:4 und 9:16 werden unterstützt
Anwendungsfälle
Kinetische Typografie
Eine gezeichnete Spur wird zu lesbarer Schrift und hält. Die Typo bleibt korrekt gesetzt, lateinisch wie japanisch.
Isometrische 3D-Aufbauten
Kacheln heben sich, Türme wachsen, Wege verbinden sich. So baut sich eine Produkttour vor den Augen selbst auf.
Technische Schemata
Strichzeichnungen bauen sich selbst: Ein Grundriss kippt ins Isometrische, dann blenden Maße und Anmerkungen auf.
Collage und Ausschnitt
Papierfetzen und gerasterte Drucktexturen schieben sich ins Bild und rasten zum Motiv ein. Das wirkt handgemacht.
Druck- und Riso-Optik
Zweifarbiger Druck, grobes Raster und bewusster Versatz, wie ihn ein zweiter Druckdurchgang hinterlässt.
Szenen aus dem Ton heraus
Bild und Ton entstehen zusammen. Eine Szene um ein präzises Geräusch herum bringt dieses Geräusch schon mit.
Prompt-Beispiele
Überblick
MiniMax H3 Max stammt nicht von MiniMax. Gebaut hat es fal.
Der Hergang ist kurz. MiniMax legte H3 im August 2026 offen. fal nahm diese Gewichte, trainierte sie auf eigenen Daten nach und stellte den eigenen Inferenz-Stack dahinter.
Heraus kommt ein Clip von 5 bis 15 Sekunden. Bis zu 768p, 24 fps, dazu Stereoton, der mit dem Bild entsteht und nicht danach.
Warum der Name verwirrt
Max liest sich wie eine Qualitätsstufe. Anderswo heißt dieselbe Stufe Pro.
Hier trägt das nicht. Ein Dritter hat ein offenes Modell nachtrainiert, mehr steht nicht dahinter. Kein größeres H3, kein feineres, und keines aus dem Hause MiniMax.
Daraus folgt die Angabe, über die die meisten stolpern. Die Auflösungsgrenze liegt unter der des Modells, von dem H3 Max abstammt. Nicht darüber.
Woher die Grenze kommt
H3 besteht aus drei Teilen.
Ein Vorverarbeiter liest das Briefing und schreibt es strukturiert um. Das Basismodell rendert daraus 768 Pixel an der kurzen Kante. Ein dritter Baustein regeneriert dieses Ergebnis in 2K und zieht dafür das ursprüngliche Briefing erneut heran, damit feine Details und kleine Schrift zurückgewonnen und nicht geraten werden.
Offengelegt hat MiniMax allein den mittleren Teil.
Wer daraus nachtrainiert, erbt also einen nativen 768p-Generator, hinter dem nichts mehr kommt. Genau darin liegt der Handel: kein hochauflösendes Finish, dafür alles auf Tempo.
Was das Tempo ändert
Bei einer halben Minute pro Generierung ist das Ergebnis eine Abgabe. Sie schicken sie los und wenden sich anderem zu.
Bei drei Sekunden ändert sich die Arbeitsweise. Aus der Abgabe wird ein Werkzeug, an dem Sie bleiben.
Im Agenturalltag heißt das dreierlei. Ein Opener geht in zwanzig Fassungen durch die Runde, und jede wird als fertige Bewegung beurteilt statt als Storyboard. Eine Abstimmungsschleife mit dem Kunden endet nicht am Folgetag, sondern im laufenden Termin. Und die Variante, an die im Team nur einer glaubt, kostet keine Diskussion mehr, sondern drei Sekunden.
Die geringere Auflösung ist der ehrliche Preis dafür. Für Social, für eine Schulung, für den internen Schnitt und für jeden Entwurf auf dem Weg zum Master reichen 768p. Für das Master selbst reichen sie nicht. Dort führt der Weg zurück zu H3.
MiniMax H3 Max auf Morphic
In der Videomodell-Auswahl steht H3 Max neben MiniMax H3, Seedance, Kling und Veo.
Briefing schreiben, generieren, fertig. Der Take landet auf dem Canvas. Dort schicken Sie dasselbe Briefing durch ein zweites Modell und legen beide nebeneinander.
Zwei Gewohnheiten zahlen sich bei diesem Modell besonders aus, und beide gelten für jedes andere genauso. Schreiben Sie die Handlung über den Clip hinweg, statt ein Einzelbild zu beschreiben. Und führen Sie den Ton so bewusst wie das Bild.
Einfache Preise
Starten Sie noch heute kostenlos, mit der Option, jederzeit zu upgraden oder zu kündigen.
Basic
2400 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Standard
3625 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Pro
6350 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Max
24650 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Enterprise
Für höhere Limits
Individuell
Preis- und Abrechnungsbedingungen

Free
Zum Ausprobieren
$0
dauerhaft kostenlos
Häufig gestellte Fragen
ChatGPT Images 2.5
OpenAI
OpenAIs Bildmodell, erschienen im September 2026. Schärfere Details, präzise Edits, kürzere Wartezeit.
Lyria 3.5
Google DeepMind
Googles bestklingendes Musikmodell. Ganze Songs mit Aufbau und Gesang.
MiniMax H3 Max Turbo
fal.ai
Das Tempo-Modell von fal, aus H3 Max. Doppelt so schnell, fast gleiche Optik.
Inworld TTS 2
Inworld
Eine Stimme, über 100 Sprachen. 95 Stimmen, erster Ton in Echtzeit.