Bernini
por ByteDance
O modelo de código aberto da ByteDance para editar vídeos com instruções em texto, mantendo a identidade intacta.

Principais recursos
Especificações técnicas
Planner + DiT
Planejador Qwen2.5-VL, renderizador Wan2.2 de 14B
Edit, Generate, R2V
Edição, geração, sujeito para vídeo
480p / 16fps
Configuração padrão de renderização
Apache 2.0
Pesos abertos, hospedável no seu próprio servidor
Casos de uso
Aumente imagens reais
Adicione ou remova elementos, corrija um detalhe ou reestilize algo em um clipe sem regravar. O bloqueio de consistência mantém o resto do plano idêntico, então a edição parece nativa.
Personagens e avatares recorrentes
Mantenha o mesmo rosto em episódios, anúncios ou uma série de avatar. O sujeito para vídeo preserva a identidade de uma pessoa a partir de poucas imagens de referência enquanto ela se move por novas cenas.
Provador virtual e inserção de produto
Troque a roupa em um modelo em movimento a partir de uma referência, ou insira um produto ou vídeo na tela em um plano, para trabalhos de moda e anúncios que precisam manter o clipe original intacto.
Reformule uma ação
Mude o que alguém está fazendo em uma tomada, um sujeito em pé vira um agachamento, sem regravar. A edição de movimento altera a ação mantendo identidade, enquadramento e iluminação fixos.
Exemplos de prompts
Edição com consistência
Adicione um boneco de neve ao lado do cachorro na trilha nevada, e mantenha o cachorro, a estrada e as árvores sem alterações
Edit promptSujeito com identidade travada
Coloque essa pessoa em um terraço iluminado pelas luzes da cidade à noite, virando suavemente para a câmera, mantendo o rosto e a jaqueta
Edit promptTroca por referência
Troque a camisa externa pela da imagem de referência, mantendo a pose, a iluminação e o movimento exatamente iguais
Edit promptVisão geral
Bernini é o framework de código aberto da ByteDance para geração e edição de vídeo com IA, lançado sob a licença Apache 2.0 em junho de 2026. O design divide o trabalho em duas partes, um planejador baseado em MLLM (Qwen2.5-VL) decide a semântica do resultado, depois um renderizador baseado em DiT, construído sobre o Wan2.2, pinta os pixels. Como o plano e a renderização são etapas separadas, o Bernini é excepcionalmente bom naquilo em que a maioria dos modelos de vídeo tem dificuldade, editar um clipe real mantendo intacto tudo o que você não pediu para mudar. Ele cobre texto para imagem, edição de imagem, texto para vídeo, edição de vídeo por instruções, edições guiadas por referência como trocas de roupa e inserção de vídeo, e sujeito para vídeo, cujo resultado de destaque é preservar a identidade de uma pessoa enquanto ela se move por uma nova cena.
Preços simples
Comece grátis hoje mesmo, com a opção de fazer upgrade ou cancelar quando quiser.
Basic
1100 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Standard
3625 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Pro
6350 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Pro Max
24650 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Enterprise
Para limites maiores
Personalizado
termos de preços e cobrança

Free
Para experimentar
$0
grátis para sempre
Perguntas frequentes
Mais sobre o Bernini
Guias, prompts e comparações para o Bernini.
Outros modelos
Explore o restante do catálogo de modelos do Morphic.
ChatGPT Images 2.5
OpenAI
Detalhe mais nítido e edição que não bagunça o resto do quadro. O modelo de imagem da OpenAI, de setembro de 2026.
Lyria 3.5
Google DeepMind
O melhor modelo de música do Google. Músicas inteiras, com voz e letra.
MiniMax H3 Max Turbo
fal.ai
O nível rápido do H3 da fal. O dobro da velocidade, quase igual.
Inworld TTS 2
Inworld
Noventa e cinco vozes, 100+ idiomas. A fala começa em menos de um segundo.