Gemini Omni Flash 1.1
de Google DeepMind
El modelo de video de Google que diriges escribiendo.
Ahora con 4K y escenas de 40 segundos.

Funciones clave
Especificaciones técnicas
Gemini Omni
Segundo lanzamiento Omni Flash dentro de la familia Omni de Google
5 tareas
Texto, imagen, referencia, edición y extensión
De 3 a 10s
Por generación; con extensiones el total llega a 40 segundos
Hasta 4K
360p y 720p nativos, 1080p y 4K por upscale
10 + 3
Diez imágenes más tres clips de video de hasta 3s cada uno
Nativo
Diálogo, efectos y música en la misma pasada
16:9, 9:16
Horizontal y vertical en todas las resoluciones
SynthID
Marca de origen invisible en cada clip generado
Casos de uso

Ediciones que escribes
Le pasas el clip y dices el cambio: otro clima, pásalo a anime, reescribe el letrero. El resto del cuadro queda como se filmó.

Personajes que hablan
Escribes la línea y el personaje la dice, con los labios sincronizados y una voz que aguanta cada corte y cada edición posterior.

Fieles a la referencia
Una foto del producto, un retrato de la presentadora y tres segundos del movimiento se vuelven un solo spot fiel al producto.

Escenas que crecen a 40s
Generas el primer tiempo y lo extiendes de diez en diez segundos hasta una escena de 40, con el mismo elenco, locación y música.

Explicaciones con física
Gravedad, fluidos y choques siguen las reglas del mundo real, y la base de Gemini en ciencia e historia cuida el detalle.

Títulos dentro del cuadro
El texto en pantalla vuelve legible, del letrero inferior al rótulo de una tienda, y una edición posterior reescribe lo que dice.
Ejemplos de prompts
Mercado nocturno
Un mercado nocturno después de la lluvia, pregones y woks chisporroteando
Edit promptDescripción general
Gemini Omni Flash 1.1 es la segunda versión del modelo de video multimodal de Google DeepMind, y la primera en la que una toma tiene espacio para crecer. Una generación sigue durando de 3 a 10 segundos con audio nativo, pero la 1.1 suma los controles que le faltaban a la primera: una escalera de resolución que va del boceto en 360p a la entrega en 4K, referencias en video que de verdad guían el resultado, un cuadro final que convierte dos imágenes fijas en un movimiento, y una extensión que lleva el clip a 40 segundos sin perder el elenco ni la música.
Qué trae de nuevo la versión 1.1
El primer Omni Flash renderizaba todo en 720p y se detenía a los diez segundos. La 1.1 conserva ese centro rápido y conversado, y quita los techos que lo rodeaban. La resolución ahora se elige en cada generación: 360p para iterar barato, y upscale a 1080p o 4K cuando la toma ya está lista para salir. La entrada de referencias crece a diez imágenes más tres clips cortos, cada uno con su papel marcado en el prompt. Y un clip terminado dejó de ser el final del camino: la extensión lee el último tramo de imagen y continúa la escena, de diez en diez segundos, hasta cuatro veces el largo original.
Edición por conversación, en vez de volver a tirar los dados
La mayoría de los modelos de video tratan el prompt como una palanca de máquina tragamonedas. Omni Flash lo trata como la primera frase de una sesión. El modelo sostiene la escena entre turnos, así que “pon el abrigo en rojo”, “ahora extiende la toma mientras ella se voltea” y “cambia el letrero a CLOSED” caen sobre la misma toma, con rostros, vestuario y voces intactos. Las instrucciones cortas, de un cambio por turno, rinden mejor. Y las partes del cuadro que nunca mencionas son justo las que no se mueven.
Gemini Omni Flash 1.1 en Morphic
En Morphic, Gemini Omni vive en el selector de modelos de video junto a Veo 3.1, Seedance 2.5, Kling y el resto del catálogo. Escribe la toma como un brief que ya incluye el audio, adjunta imágenes de referencia para todo lo que deba mantenerse igual, y genera. La toma cae en el Canvas, donde el mismo brief puede pasar por otro modelo para una lectura lado a lado. Después sigues refinando en los turnos siguientes, un cambio a la vez, y la escena conserva su contexto de un turno al otro.
Precios simples
Comienza gratis hoy, con la opción de mejorar tu plan o cancelar cuando quieras.
Basic
1100 mensual créditos
1 usuario
Todos los modelos
Workflows
Standard
3625 mensual créditos
1 usuario
Todos los modelos
Workflows
Pro
6350 compartidos mensual créditos
1 usuario
Todos los modelos
Workflows
Pro Max
24650 compartidos mensual créditos
1 usuario
Todos los modelos
Workflows
Enterprise
Para límites más altos
Personalizado
términos de precios y facturación

Free
Para experimentar
$0
gratis para siempre
Preguntas frecuentes
ChatGPT Images 2.5
OpenAI
El modelo de imagen de OpenAI, de septiembre de 2026. Más detalle, ediciones precisas, más rápido.
Lyria 3.5
Google DeepMind
El mejor modelo musical de Google. Canciones con estructura, voz y letra.
MiniMax H3 Max Turbo
fal.ai
El nivel rápido del H3 afinado por fal. El doble de rápido, casi igual de bueno.
Inworld TTS 2
Inworld
95 voces y más de 100 idiomas. La voz arranca en menos de un segundo.