Gemini Omni Flash 1.1
par Google DeepMind
Le modèle vidéo de Google où la retouche s’écrit.
Désormais en 4K et jusqu’à 40 secondes.

Fonctionnalités clés
Spécifications techniques
Gemini Omni
Deuxième version d’Omni Flash dans la famille Omni de Google
5 tâches
Texte, image, référence, retouche et extension
3 à 10 s
Par génération ; les extensions montent à 40 secondes au total
Jusqu’en 4K
360p et 720p en natif, 1080p et 4K en upscale
10 + 3
Dix images et trois extraits vidéo de 3 s maximum chacun
Natif
Dialogues, bruitages et musique dans la même passe
16:9, 9:16
Paysage et vertical, à toutes les résolutions
SynthID
Marque de provenance invisible sur chaque plan généré
Cas d'utilisation

Les retouches s’écrivent
Donnez un plan, puis le changement : une autre météo, un rendu anime, une enseigne réécrite. Le reste du cadre ne bouge pas.

Personnages qui parlent
Écrivez la réplique : le personnage la dit, lèvres synchronisées, avec une voix qui traverse les coupes et les retouches.

Spots fidèles aux références
Un packshot, la photo d’un présentateur et trois secondes du mouvement voulu donnent un spot où le produit reste juste.

Scènes portées à 40 secondes
Générez le premier temps, puis prolongez-le dix secondes à la fois jusqu’à 40, sans changer de personnages ni de musique.

Pédagogie, physique juste
Gravité, fluides et collisions suivent les lois du réel, et l’ancrage de Gemini en sciences et en histoire tient le détail.

Du texte lisible à l’image
Le texte incrusté revient lisible, du synthé au fronton de boutique, et une retouche suivante peut en changer le libellé.
Exemples de prompts
Gros plan sonore
Gros plan sur un café filtre, chaque goutte et chaque sifflement audibles
Edit promptAperçu
Gemini Omni Flash 1.1 est la deuxième version du modèle vidéo multimodal de Google DeepMind. C’est aussi la première où un plan peut grandir. Une génération dure toujours de 3 à 10 secondes, audio natif compris. Ce que 1.1 ajoute, ce sont les commandes qui manquaient : une échelle de résolution qui va de l’ébauche en 360p à la livraison en 4K, des vidéos de référence qui orientent vraiment le résultat, une image de fin qui transforme deux photos en un mouvement, et une extension qui porte le plan à 40 secondes sans perdre ni les personnages ni la musique.
Les nouveautés de Gemini Omni Flash 1.1
Le premier Omni Flash rendait tous ses plans en 720p et s’arrêtait à dix secondes. La 1.1 garde ce cœur rapide et conversationnel, puis retire les plafonds autour. La résolution se choisit maintenant à chaque génération : 360p pour itérer sans compter, 1080p ou 4K en upscale quand la prise est bonne. Les entrées de référence passent à dix images plus trois courts extraits, chacun affecté à un rôle dans le prompt. Et un plan terminé n’est plus une fin de ligne : l’extension relit les dernières secondes et poursuit la scène, dix secondes à la fois, jusqu’à quatre fois la durée d’origine.
Retoucher la vidéo par le dialogue, sans tout relancer
La plupart des modèles vidéo traitent un prompt comme un tirage de machine à sous. Omni Flash le traite comme la première mesure d’une séance. La scène reste en mémoire d’un tour à l’autre, et l’anglais reste la langue de référence du modèle. « make the jacket red », « now extend the shot as she turns away », « change the sign to say CLOSED » : les trois s’appliquent à la même prise, visages, costumes et voix intacts. Les instructions courtes, à un seul changement, donnent les meilleurs résultats. Et ce que vous ne mentionnez jamais est précisément ce qui ne bouge pas.
Gemini Omni Flash 1.1 sur Morphic
Sur Morphic, Gemini Omni figure dans le sélecteur de modèles vidéo, aux côtés de Veo 3.1, Seedance 2.5, Kling et du reste du catalogue. Rédigez le plan comme un brief, son compris. Joignez des images de référence pour tout ce qui doit rester identique, puis générez. La prise arrive sur le Canvas, où le même brief peut passer par un autre modèle pour une lecture côte à côte. Continuez en relances, un changement précis à la fois : la scène garde son contexte d’un tour au suivant.
Tarifs simples
Commencez gratuitement dès aujourd'hui, avec la possibilité de mettre à niveau ou d'annuler à tout moment.
Basic
1100 mensuel crédits
1 utilisateur uniquement
Tous les modèles
Workflows
Standard
3625 mensuel crédits
1 utilisateur uniquement
Tous les modèles
Workflows
Pro
6350 partagé mensuel crédits
1 utilisateur
Tous les modèles
Workflows
Pro Max
24650 partagé mensuel crédits
1 utilisateur
Tous les modèles
Workflows
Enterprise
Pour des limites plus élevées
Personnalisé
conditions de tarification et de facturation

Free
Pour expérimenter
$0
gratuit pour toujours
Questions fréquentes
ChatGPT Images 2.5
OpenAI
Le modèle d'image d'OpenAI, sorti en septembre 2026. Plus de détail, des retouches ciblées, plus de vitesse.
Lyria 3.5
Google DeepMind
Le meilleur modèle musical de Google. Des chansons entières, voix et paroles.
MiniMax H3 Max Turbo
fal.ai
Le palier rapide du H3 signé fal. Deux fois plus vite, rendu quasi égal.
Inworld TTS 2
Inworld
95 voix, plus de 100 langues. La voix part en moins d’une seconde.