Gemini Omni Flash 1.1
por Google DeepMind
O modelo de vídeo do Google: a edição é uma frase.
Agora em 4K e com cenas de 40 segundos.

Principais recursos
Especificações técnicas
Gemini Omni
Segundo lançamento Omni Flash na família Omni do Google
5 tarefas
Texto, imagem, referência, edição e extensão
3 a 10s
Por geração; com extensões, chega a 40 segundos no total
Até 4K
360p e 720p nativos, 1080p e 4K por upscale
10 + 3
Dez imagens mais três clipes de vídeo de até 3s cada
Nativo
Diálogo, efeitos e música na mesma passada
16:9, 9:16
Horizontal e vertical em todas as resoluções
SynthID
Marca de origem invisível em todo clipe gerado
Casos de uso

Edições que você digita
Entregue um clipe e diga a mudança: trocar o tempo, virar anime, reescrever a placa. O resto do quadro fica como estava.

Personagens que falam
Escreva a fala e a personagem diz, com lip sync, numa voz que atravessa cada corte e cada edição seguinte.

Anúncios fiéis à referência
Uma foto do produto, um retrato da apresentadora e três segundos do movimento viram um anúncio só, com o produto fiel.

Cenas que crescem até 40s
Gere o primeiro trecho e estenda de dez em dez segundos até 40, com o mesmo elenco, o mesmo cenário e a mesma trilha.

Explicações com física
Gravidade, fluidos e colisões seguem as regras do mundo real, e a base do Gemini em ciência e história cuida do detalhe.

Texto escrito no quadro
O texto na tela volta legível, do letreiro à placa da loja, e a edição seguinte reescreve o que está escrito ali.
Exemplos de prompts
Visão geral
O Gemini Omni Flash 1.1 é a segunda versão do modelo de vídeo multimodal do Google DeepMind, e a primeira com espaço para o plano crescer. Uma geração continua entre 3 e 10 segundos, com áudio nativo, mas a 1.1 traz os controles que faltavam na estreia: uma escada de resolução que vai do rascunho em 360p à entrega em 4K, referências de vídeo que guiam mesmo o resultado, um quadro final que transforma duas imagens em um movimento, e a extensão que leva o clipe a 40 segundos sem perder o elenco nem a trilha.
O que mudou no Gemini Omni Flash 1.1
O primeiro Omni Flash renderizava tudo em 720p e parava nos dez segundos. A 1.1 mantém esse núcleo rápido, que responde a conversa, e derruba os tetos em volta dele. A resolução virou escolha de cada geração: 360p para iterar barato, 1080p ou 4K quando a tomada está pronta para sair. A entrada de referências cresceu para dez imagens mais três clipes curtos, cada um com seu papel definido no prompt. E um clipe pronto deixou de ser o fim da linha: a extensão lê o último trecho gravado e continua a cena, dez segundos por vez, até quatro vezes o tamanho original.
Edição por conversa, sem regerar do zero
A maioria dos modelos de vídeo trata o prompt como um sorteio. O Omni Flash trata como a primeira frase de uma conversa. O modelo guarda a cena entre as rodadas, então “deixe a jaqueta vermelha”, “agora estenda o plano enquanto ela se vira” e “troque a placa para CLOSED” caem todas na mesma tomada, com rosto, roupa e voz intactos. Instruções curtas, uma mudança por vez, funcionam melhor. E as partes do quadro que você nunca citou são justamente as que não se mexem.
Gemini Omni Flash 1.1 no Morphic
No Morphic, o Gemini Omni fica no seletor de modelos de vídeo ao lado do Veo 3.1, do Seedance 2.5, do Kling e do resto do catálogo. Escreva o plano como um briefing que já inclui o áudio, anexe as imagens de referência do que precisa ficar igual e gere. A tomada cai no Canvas, onde o mesmo briefing pode rodar em outro modelo para uma leitura lado a lado. Siga refinando nas respostas seguintes, uma mudança de cada vez, e a cena guarda o contexto de uma rodada para a outra.
Preços simples
Comece grátis hoje mesmo, com a opção de fazer upgrade ou cancelar quando quiser.
Basic
1100 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Standard
3625 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Pro
6350 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Pro Max
24650 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Enterprise
Para limites maiores
Personalizado
termos de preços e cobrança

Free
Para experimentar
$0
grátis para sempre
Perguntas frequentes
ChatGPT Images 2.5
OpenAI
Detalhe mais nítido e edição que não bagunça o resto do quadro. O modelo de imagem da OpenAI, de setembro de 2026.
Lyria 3.5
Google DeepMind
O melhor modelo de música do Google. Músicas inteiras, com voz e letra.
MiniMax H3 Max Turbo
fal.ai
O nível rápido do H3 da fal. O dobro da velocidade, quase igual.
Inworld TTS 2
Inworld
Noventa e cinco vozes, 100+ idiomas. A fala começa em menos de um segundo.