Gemini Omni Flash 1.1
von Google DeepMind
Googles Videomodell: Die Änderung ist ein Satz.
Jetzt mit 4K und Szenen bis 40 Sekunden.

Hauptfunktionen
Technische Spezifikationen
Gemini Omni
Zweite Omni-Flash-Fassung in Googles Omni-Reihe
5 Aufgaben
Text, Bild, Referenz, Bearbeitung und Verlängerung
3 bis 10 s
Pro Generierung; Verlängerungen reichen bis 40 Sekunden gesamt
Bis zu 4K
360p und 720p nativ, 1080p und 4K hochskaliert
10 + 3
Zehn Bilder plus drei Videoclips von je bis zu 3 Sekunden
Nativ
Dialog, Effekte und Musik im selben Durchgang
16:9, 9:16
Quer- und Hochformat in jeder Auflösung
SynthID
Unsichtbares Herkunftszeichen in jedem erzeugten Clip
Anwendungsfälle

Änderungen per Satz
Clip übergeben, Änderung nennen: anderes Wetter, Anime-Look, neuer Schriftzug. Der Rest des Bildes bleibt, wie er gedreht wurde.

Figuren, die sprechen
Sie schreiben die Zeile, die Figur spricht sie lippensynchron. Die Stimme übersteht jeden Schnitt und jede weitere Bearbeitung.

Spots nah an der Referenz
Produktfoto, Porträt und ein Drei-Sekunden-Clip der Bewegung ergeben einen Spot, in dem das Produkt bleibt, was es ist.

Szenen bis 40 Sekunden
Erst den Auftakt erzeugen, dann in Zehn-Sekunden-Schritten auf 40 Sekunden verlängern. Besetzung, Ort und Musik bleiben.

Erklärvideos mit Physik
Schwerkraft, Flüssigkeiten und Stöße folgen realen Regeln. Geminis Wissen aus Wissenschaft und Geschichte hält Details korrekt.

Titel direkt im Bild
Text im Bild kommt lesbar zurück, von der Bauchbinde bis zum Ladenschild. Eine Folgeanweisung schreibt ihn bei Bedarf um.
Prompt-Beispiele
Überblick
Gemini Omni Flash 1.1 ist die zweite Fassung von Google DeepMinds multimodalem Videomodell und die erste, in der eine Aufnahme wachsen darf. Eine Generierung läuft weiterhin 3 bis 10 Sekunden mit nativem Ton. Neu sind die Regler, die der ersten Fassung fehlten: Auflösungsstufen von 360p für Entwürfe bis 4K für die Auslieferung, Videoreferenzen, die tatsächlich steuern, ein Endbild, das aus zwei Standbildern eine Bewegung macht, und eine Verlängerung, die den Clip auf 40 Sekunden bringt, ohne Besetzung oder Musik zu verlieren.
Was an Gemini Omni Flash 1.1 neu ist
Die erste Fassung gab jeden Clip in 720p aus und endete nach zehn Sekunden. Version 1.1 behält den schnellen, dialogischen Kern und nimmt die Deckel darüber weg. Die Auflösung wählen Sie pro Generierung: 360p für günstige Durchläufe, 1080p oder 4K, sobald eine Aufnahme ausgeliefert wird. Wichtig für die Planung: Nativ rendert das Modell in 360p und 720p, die beiden großen Stufen entstehen durch Hochskalierung. Die Referenzen wachsen auf zehn Bilder plus drei kurze Clips, jeder mit einer Rolle im Prompt. Und ein fertiger Clip ist nicht mehr das Ende der Fahnenstange: Die Verlängerung liest die letzten Sekunden und führt die Szene fort, zehn Sekunden pro Schritt, bis zur vierfachen Ausgangslänge.
Bearbeiten im Dialog statt neu würfeln
Die meisten Videomodelle behandeln einen Prompt wie den Hebel am Spielautomaten. Hier ist er der erste Takt einer Sitzung. Das Modell hält die Szene zwischen den Zügen, deshalb landen „make the jacket red“, „now extend the shot as she turns away“ und „change the sign to say CLOSED“ alle auf derselben Aufnahme, mit Gesichtern, Garderobe und Stimmen. Kurze Anweisungen mit genau einer Änderung wirken am besten. Und was Sie nie erwähnen, bewegt sich auch nicht. Die Beispiele bleiben englisch, denn Englisch ist die Sprache, für die Google das Modell dokumentiert.
Gemini Omni Flash 1.1 und Morphic
Auf Morphic steht Gemini Omni in der Modellauswahl für Video, neben Veo 3.1, Seedance 2.5, Kling und dem übrigen Katalog. Schreiben Sie die Einstellung als kurze Regieanweisung, die den Ton einschließt, hängen Sie Referenzbilder an alles, was gleich bleiben muss, und generieren Sie. Die Aufnahme landet auf dem Canvas, wo dieselbe Vorgabe durch ein zweites Modell laufen kann, für den direkten Vergleich. Danach arbeiten Sie in Folgeprompts weiter, eine Änderung pro Zug, und die Szene behält ihren Zusammenhang von Zug zu Zug.
Einfache Preise
Starten Sie noch heute kostenlos, mit der Option, jederzeit zu upgraden oder zu kündigen.
Basic
2400 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Standard
3625 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Pro
6350 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Max
24650 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Enterprise
Für höhere Limits
Individuell
Preis- und Abrechnungsbedingungen

Free
Zum Ausprobieren
$0
dauerhaft kostenlos
Häufig gestellte Fragen
ChatGPT Images 2.5
OpenAI
OpenAIs Bildmodell, erschienen im September 2026. Schärfere Details, präzise Edits, kürzere Wartezeit.
Lyria 3.5
Google DeepMind
Googles bestklingendes Musikmodell. Ganze Songs mit Aufbau und Gesang.
MiniMax H3 Max Turbo
fal.ai
Das Tempo-Modell von fal, aus H3 Max. Doppelt so schnell, fast gleiche Optik.
Inworld TTS 2
Inworld
Eine Stimme, über 100 Sprachen. 95 Stimmen, erster Ton in Echtzeit.