Gemini Omni
von Google DeepMind
Googles erstes Any‑to‑any‑KI‑Modell.
Text, Bild, Audio und Video rein, ein fertiges Video raus.

Hauptfunktionen
Technische Spezifikationen
Omni Flash
Erstes Modell in Googles Gemini-Omni-Reihe
Video
Bild- und Audioausgabe sind für die Gemini-Omni-Roadmap geplant
Bis zu 10s
Flash-Clips sind zum Start auf 10 Sekunden begrenzt, um den Zugang zu erweitern
720p
Gemini Omni Flash gibt Video in 720p aus
Beliebige Mischung
Text, Bild, Audio und Video in einem Prompt
Nativ
Synchronisiertes Audio wird mit jedem Clip erzeugt; Stimme über Avatare
SynthID
Unmerkliches KI-Herkunftswasserzeichen auf jedem Clip
Google DeepMind
Positioniert als Nachfolger von Veo für Any-to-any-Videoerstellung
Anwendungsfälle
Multimodales Storyboarding
Ein Charakterbild, ein Ortsfoto, ein Musik-Cue und ein Stichwort gehen ein, das Modell baut die Einstellung und arbeitet iterativ weiter.
Konversationelle Videobearbeitung
Bearbeiten Sie jeden Clip in normaler Sprache: Garderobe tauschen, Hintergrund ändern oder einen Moment neu timen. Der Rest bleibt stabil.
Marketingvideo
Werbeschnitte, die Markenfarben, Produktform und Bildschirmtext respektieren. Ein Foto, ein Briefing, ein fertiger Spot.
Lehrvideos und Erklärvideos
Visualisieren Sie Naturwissenschaft, Geschichte und Technik mit eingebauter Physik. Die Fakten bleiben korrekt, das Material sauber.
Sprecher-Video
Ein Porträt plus eine Stimmreferenz ergibt denselben Präsentator vor der Kamera über Shorts, Kurse und Anleitungen hinweg.
Social Shorts
10-Sekunden-Clips passen zu YouTube Shorts, Reels und TikTok. Erzeugen Sie Varianten und veröffentlichen Sie die beste.
Prompt-Beispiele

Cinematic Noir
Detektiv in einer regennassen Tokioter Gasse, Natriumlampen-Glühen, Teal-Amber-Noir
Edit prompt
Produktlaunch
Avantgardistischer Sneaker schwebt über einem Titan-Sockel, hartes Streiflicht, Launch-Stimmung
Edit prompt
Naturerklärung
Wassertropfen erstarrt zur kristallinen Krone auf einem taufeuchten Blatt, Gegenlicht bei Sonnenaufgang, Makro
Edit prompt
Avatar-Sprecher
Souveräner Studio-Moderator blickt in die Kamera, warmes Dreipunktlicht, 85mm-Bokeh
Edit prompt
Architektur-Rundgang
Goldenes Licht durch eine brutalistische Betonvilla, lange Schatten, treibender Staub
Edit prompt
Einfache Preise
Starten Sie noch heute kostenlos, mit der Option, jederzeit zu upgraden oder zu kündigen.
Basic
900 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Standard
3200 monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Pro
6200 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Pro Max
24000 gemeinsame monatliche Credits
1 Nutzer
Alle Modelle
Workflows
Enterprise
Für höhere Limits
Individuell
Preis- und Abrechnungsbedingungen

Free
Zum Ausprobieren
$0
dauerhaft kostenlos
Häufig gestellte Fragen
Kling 4.0
Kling
Kuaishous nächstes Kling-Flaggschiff, bald erwartet. Längere Clips und mehr Detailschärfe sind unterwegs.
Flux 3
Black Forest Labs
Das Weltmodell von Black Forest Labs für Bild, Video und Audio, mit Ton, der zur Handlung passt.
Seedream 5.0 Pro
ByteDance
Präzise Bereichsbearbeitung und Ebenentrennung. Dichte Infografiken und native Texte in 14 Sprachen.
Nano Banana 2 Lite
Google DeepMind
Das schnellste Nano-Banana-Modell von Google DeepMind. 1K-Bilder in rund vier Sekunden, mit konsistenten Charakteren.