Seedance 1.5 Pro
por ByteDance
O modelo de áudio e vídeo nativos da ByteDance.
Vídeo e diálogo saem sincronizados em uma única etapa, com lip‑sync multilíngue e controle de câmera cinematográfico.
Seedance 1.5 Pro
por ByteDance
Principais recursos
Especificações técnicas
480p / 720p / 1080p
Três níveis de resolução
4–12s
Duração de cada clipe gerado
T2V + I2V
Ambos com áudio nativo
Nativo
Áudio e vídeo na mesma etapa
Casos de uso
Anúncios com narração sincronizada
Você gera o clipe do anúncio com fala, trilha e ação em cena já no tempo certo. Não precisa de uma mixagem de áudio à parte.
Drama e diálogo em formato curto
Curtas guiados por diálogo pedem que lip-sync, atuação e emoção passem como uma tomada só. É isso que o modelo entrega, inclusive nas versões em vários idiomas.
Campanhas de anúncio localizadas
Gere o mesmo anúncio com a fala em vários idiomas. Como o lip-sync fecha em cada um deles, a versão localizada não parece dublada.
Imagem para vídeo com áudio
Comece por uma imagem feita no Seedream. O Seedance 1.5 Pro anima a cena e cria o áudio correspondente na mesma etapa.
Exemplos de prompts
Anúncio com diálogo
Close de uma atendente de padaria entregando um copo de café, sorrindo, ela diz "bom dia, aproveite" em tom acolhedor, som ambiente de padaria movimentada, 8 segundos
Edit promptCena cinematográfica
Dolly lento por uma rua de paralelepípedo à noite depois da chuva, luz quente das vitrines refletindo no chão molhado, passos ecoando, trânsito ao longe, 1080p cinematográfico
Edit promptImagem para vídeo
Anime esta imagem, a personagem levanta o olhar e diz a fala baixinho, com lip-sync preciso, som ambiente suave de quarto
Edit promptVisão geral
O Seedance 1.5 Pro é o modelo de geração de vídeo com áudio nativo da ByteDance. A maioria dos modelos de vídeo encaixa o som só no final. Aqui, imagem e áudio nascem na mesma etapa. Quem cuida disso é um Diffusion Transformer de dupla ramificação com um módulo conjunto cross-modal, a arquitetura de áudio e vídeo da ByteDance. Ela segura o diálogo no tempo da ação, e mantém passos e som ambiente alinhados do primeiro ao último quadro. Some a isso o lip-sync em seis idiomas, com sotaques regionais, e uma inferência mais de 10x mais rápida. Por isso o modelo cai bem em anúncios, drama curto e qualquer criativo localizado guiado por diálogo.
Preços simples
Comece grátis hoje mesmo, com a opção de fazer upgrade ou cancelar quando quiser.
Basic
1100 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Standard
3625 mensal créditos
1 apenas usuário
Todos os modelos
Workflows
Pro
6350 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Pro Max
24650 compartilhado mensal créditos
1 usuário
Todos os modelos
Workflows
Enterprise
Para limites maiores
Personalizado
termos de preços e cobrança

Free
Para experimentar
$0
grátis para sempre
Perguntas frequentes
Outros modelos
Explore o restante do catálogo de modelos do Morphic.
ChatGPT Images 2.5
OpenAI
Detalhe mais nítido e edição que não bagunça o resto do quadro. O modelo de imagem da OpenAI, de setembro de 2026.
Lyria 3.5
Google DeepMind
O melhor modelo de música do Google. Músicas inteiras, com voz e letra.
MiniMax H3 Max Turbo
fal.ai
O nível rápido do H3 da fal. O dobro da velocidade, quase igual.
Inworld TTS 2
Inworld
Noventa e cinco vozes, 100+ idiomas. A fala começa em menos de um segundo.