Flux 3
por Black Forest Labs
O world model da Black Forest Labs para imagem, vídeo e áudio, com som que acompanha a ação.

Principais recursos
Especificações técnicas
5–20s
Segundos inteiros em uma única passada, ou duração automática de acordo com o prompt
720p / 1080p
HD por padrão, Full HD com upscaling
T2V·I2V·V2V
Texto, imagem e quadros-chave, ou continuação de um clipe existente
Nativo
Áudio sincronizado gerado com cada clipe, ativado por padrão
Casos de uso
Vídeo com som em uma só passada
Um prompt já devolve o clipe com o áudio junto, então um efeito ou uma fala nasce sincronizado à ação, em vez de ser adicionado depois.
Sequências com vários planos
Monte diferentes ângulos em uma única geração, ou estenda um clipe pela continuação, mantendo o mesmo personagem em cada corte.
Filme de produto e de marca
Materiais, peso e reflexos permanecem fiéis conforme a câmera se move, então o produto de um anúncio parece filmado, não simulado.
Vídeo localizado
Diálogo multilíngue e texto preciso na tela deixam uma cena sair em português e em outros idiomas, sem uma nova dublagem ou um novo título separado.
Transições coreografadas
Fixe as poses e composições que um plano precisa cruzar, e o modelo constrói o movimento entre elas como uma única tomada contínua.
Vídeos explicativos com física real
Gravidade, colisões e movimento seguem regras reais, então um conteúdo de ciência ou de como algo funciona fica preciso e continua limpo.
Exemplos de prompts

Clipe fiel à física
Uma caneca de cerâmica escorrega da bancada de mármore e se estilhaça no chão, os cacos se espalham, som de impacto seco em sincronia
Edit prompt
Sequência com vários planos
O mesmo entregador de jaqueta vermelha: um plano atravessando uma feira, o outro chegando a uma porta iluminada ao entardecer
Edit prompt
Cartela de título localizada
Still de marca de café brasileiro, vapor subindo de uma xícara recém-servida, título na tela com os dizeres 'Torrado na hora' em tipografia nítida e marcante
Edit prompt
De filmadora a cinematográfico
Imagem de filmadora de mão em uma festa de aniversário, depois a mesma cena como um plano aberto cinematográfico e quente, com som ambiente
Edit prompt
Continuação de clipe
Ela se afasta da janela e sai para a rua chuvosa de Tóquio à noite, a câmera acompanha sem cortes
Edit prompt
Produto de estúdio
Tênis de vanguarda girando sobre um pedestal de titânio, luz principal dura, reflexos de metal precisos, leve zumbido mecânico
Edit promptVisão geral
O Flux 3 é o modelo multimodal fundamental da Black Forest Labs, anunciado em 23 de julho de 2026, com a geração de vídeo liberada para todos em 4 de agosto de 2026. Ele aprende em conjunto a partir de imagens, vídeo e áudio dentro de uma única arquitetura. Assim, um só modelo renderiza um plano em movimento e o som que pertence a ele, mantendo uma noção coerente de como o mundo parece, se move e soa.
O que o Flux 3 faz de diferente
A maioria dos geradores trata cada modalidade como um problema separado. O Flux 3 trata imagem, vídeo e áudio como evidências sobre uma mesma realidade de fundo. O modelo foi treinado com a abordagem Self-Flow da Black Forest Labs, que usou mais de 95% de todo o poder de treinamento em previsão de vídeo. O ganho aparece como consistência física: o som combina com o impacto, o movimento obedece à massa, e um personagem mantém sua identidade de um plano para o outro. Essa mesma compreensão de mundo é o que permite estender a base à previsão de ação para robótica, já testada em tarefas reais de produção na Audi pela parceria FLUX-mimic.
O que já foi lançado, e o que ainda não
O Flux 3 Video é a parte disponível para todos: texto para vídeo, imagem para vídeo com quadros-chave e continuação de um clipe existente, tudo com até 20 segundos e áudio sincronizado. A Black Forest Labs também anunciou o Flux 3 Image para geração e edição de imagem, o Flux 3 Action para robótica, uma versão de pesos abertos chamada Flux 3 Dev, além de edição de vídeo e referências combinadas de imagem, vídeo e áudio. Por enquanto, isso tudo está no roteiro, e não na sua tela.
O Flux 3 no Morphic
O Flux 3 roda no Morphic ao lado de modelos de vídeo como Veo, Kling, Seedance e Vidu, além de toda a família Flux para imagem. Dá para mandar um mesmo prompt para dois modelos na mesma Canvas, seja para fechar um anúncio, um Reels ou um vídeo para YouTube. Essa é a forma mais rápida de descobrir se o Flux 3 é a escolha certa para um plano específico, em vez de confiar só no que um gráfico de lançamento promete.
Preços simples
Comece grátis hoje mesmo, com a opção de fazer upgrade ou cancelar quando quiser.
Basic
1100 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Standard
3625 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Pro
6350 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Pro Max
24650 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Enterprise
Para limites maiores
Personalizado
termos de preços e cobrança

Free
Para experimentar
$0
grátis para sempre
Perguntas frequentes
ChatGPT Images 2.5
OpenAI
Detalhe mais nítido e edição que não bagunça o resto do quadro. O modelo de imagem da OpenAI, de setembro de 2026.
Lyria 3.5
Google DeepMind
O melhor modelo de música do Google. Músicas inteiras, com voz e letra.
MiniMax H3 Max Turbo
fal.ai
O nível rápido do H3 da fal. O dobro da velocidade, quase igual.
Inworld TTS 2
Inworld
Noventa e cinco vozes, 100+ idiomas. A fala começa em menos de um segundo.