Kling 3.0 no Morphic: recursos e vídeo com IA

Kling 3.0 no Morphic: recursos e vídeo com IA

Crie vídeos cinematográficos com IA usando o Kling 3.0 no Morphic. Multi-shot, 4K nativo, áudio embutido e clipes de até 15 segundos.

Como usar o Kling 3.0 no Morphic

1. Selecione o modo de vídeo

Na barra de prompt, selecione o modo Vídeo. Isso muda a interface para geração de vídeo, onde você configura opções como resolução, duração e se o áudio nativo entra ou não.

2. Escolha o Kling 3.0 como seu modelo

Abra o menu de modelos e escolha o Kling 3.0 na lista de modelos de vídeo disponíveis. O Morphic oferece vários modelos de vídeo, então você compara resultados entre diferentes geradores sem trocar de plataforma.

3. Escreva seu prompt

Descreva a cena que você quer. Inclua detalhes sobre o assunto, o ambiente, o movimento de câmera, a iluminação e qualquer diálogo. Pense como um diretor, não como um fotógrafo: descreva o que acontece ao longo do tempo, não só um quadro estático. Se quiser vários planos, ative o multi-shot ou identifique cada plano no seu prompt.

4. Gere o vídeo

Rode o prompt. O Kling 3.0 gera clipes de 3 a 15 segundos, com áudio nativo incluído quando ativado. Revise o resultado, ajuste o prompt se precisar e gere de novo até chegar no clipe que você quer.

O que é o Kling 3.0?

O Kling 3.0 é o modelo de geração de vídeo com IA mais recente da Kuaishou, lançado em fevereiro de 2026. Ele parte dos modelos Kling Video 2.6 e Kling O1, unificando os dois numa arquitetura multimodal só que processa vídeo, áudio e texto numa única geração.

Enquanto os modelos de vídeo com IA anteriores entregavam clipes isolados, de um plano só e sem áudio, o Kling 3.0 gera sequências multi-shot com diálogo sincronizado e áudio nativo. O modelo entende linguagem cinematográfica (travellings, close-ups, shot-reverse-shot) e planeja as transições de cena sozinho quando você descreve uma narrativa no prompt.

O Kling 3.0 está disponível no Morphic dentro do conjunto de ferramentas de geração de vídeo da plataforma, o que significa que você usa esse modelo junto com as ferramentas de imagem, música e áudio do Morphic no mesmo espaço de trabalho.

Recursos e capacidades do Kling 3.0

Storyboard multi-shot com dois modos de controle

Esse é o recurso que separa o Kling 3.0 de qualquer outro modelo de vídeo com IA disponível hoje. Ele gera até seis cortes de câmera numa única geração, e te dá duas formas de controlar isso:

  • Multi-shot automático: ative o multi-shot e o modelo planeja as transições de plano sozinho, com base no seu prompt. Ele lê a descrição da cena e decide onde cortar, qual ângulo usar e como ritmar a sequência.
  • Multi-shot personalizado: você define cada plano manualmente. Define o número de planos, a duração de cada um, o ângulo de câmera e o que acontece no quadro. O modelo segue seu storyboard à risca.

O modo automático funciona bem quando você quer um resultado rápido a partir de um prompt narrativo. O modo personalizado é melhor quando você precisa de controle preciso, por exemplo ao montar um anúncio de produto com um ritmo de corte específico.

Referências de elementos com voz vinculada

A maioria dos modelos de vídeo com IA deixa você subir uma imagem de referência para fixar a aparência de um personagem. O Kling 3.0 vai além. Você sobe um clipe de vídeo curto como referência, e o modelo extrai tanto a aparência visual do personagem quanto o tom de voz natural dele. Essa voz fica vinculada ao elemento do personagem, então toda vez que esse personagem fala no seu vídeo, a voz continua consistente sem você precisar especificar isso de novo no prompt.

Você também cria elementos a partir de 2 a 4 imagens de referência e atribui um tom de voz separadamente, subindo um áudio ou escolhendo entre as vozes disponíveis. Isso é especialmente útil para personagens recorrentes em várias gerações de vídeo.

Dialeto, sotaque e alternância entre idiomas

O áudio nativo do Kling 3.0 suporta cinco idiomas: inglês, chinês, japonês, coreano e espanhol. Mas vai além do suporte básico de idioma. O modelo reproduz dialetos e sotaques específicos, incluindo cantonês, dialeto do nordeste da China, sichuanês e dialeto de Pequim para o chinês, além de sotaques americano, britânico e indiano para o inglês.

Ele também lida com alternância de idioma no meio da fala, ou seja, personagens trocam de idioma no meio de uma conversa dentro do mesmo vídeo. Uma reunião de negócios bilíngue, um turista pedindo informação num espanhol quebrado ou uma cena de família misturando dialetos, tudo isso gera com movimentos labiais naturais e expressões faciais coerentes.

Vídeo em 4K nativo

O modelo suporta resolução de até 4K nativa, não é upscale de uma resolução menor. Isso significa que texturas, detalhes de pele e elementos finos como trama de tecido e fios de cabelo mantêm um detalhe autêntico, em vez daquele visual suave e borrado que o upscale costuma gerar. Resoluções menores (1080p e 720p) também estão disponíveis, e o modelo suporta proporções 16:9, 9:16 e 1:1.

Preservação de texto e logo durante o movimento de câmera

O Kling 3.0 lê texto em imagens que você sobe, como placas, rótulos de produto ou logos, e mantém esse texto legível durante todo o vídeo mesmo com a câmera em movimento. Ele também gera novo conteúdo de texto dentro do próprio vídeo. Para trabalhos comerciais em que o texto da marca precisa continuar nítido durante uma órbita de produto ou um travelling, isso elimina a necessidade de sobreposição de texto na pós-produção.

Consistência de personagem em sequências multi-shot

Suba imagens de referência ou um vídeo de referência curto, e o modelo trava a aparência de um personagem durante todo o clipe. Rosto, roupa, proporções e detalhes distintivos se mantêm firmes mesmo com zooms, pans e tilts de câmera. O modelo suporta três ou mais personagens distintos na mesma cena sem misturar as características deles, o que importa muito em cenas de diálogo e em qualquer vídeo com várias pessoas.

Duração flexível de 3 a 15 segundos

Gere de 3 a 15 segundos de vídeo contínuo numa única passada. A duração extra não é só sobre clipes mais longos. Ela dá espaço para o modelo desenvolver ações mais complexas, construir transições de cena e deixar um arco narrativo se desenrolar em vez de cortar seco na marca dos cinco segundos.

Perguntas frequentes

O Kling 3.0 está disponível no Morphic?

O Kling 3.0 está disponível no Morphic como parte do conjunto de geração de vídeo. Para começar a gerar, crie uma conta num plano do Morphic, selecione o modo Vídeo na barra de prompt e escolha o Kling 3.0 no menu de modelos. Confira os planos disponíveis direto no Morphic. A plataforma dá acesso ao Kling 3.0 junto com ferramentas de imagem, música e áudio, então todo o seu fluxo criativo fica num só lugar.

Qual é a diferença entre o Kling 3.0 e o Kling 3.0 Omni?

O Kling 3.0 é o modelo principal de geração de vídeo, cobrindo texto para vídeo e imagem para vídeo com storyboard multi-shot e áudio nativo. O Kling 3.0 Omni parte dessa base com controles mais fortes de consistência de personagem e a capacidade de vincular tons de voz a personagens específicos usando vídeos de referência. Para a maioria das necessidades de geração de vídeo, o Kling 3.0 é o ponto de partida certo. O Omni vale a pena quando a consistência de personagem entre várias gerações é prioridade.

Quais idiomas e sotaques o áudio do Kling 3.0 suporta?

O Kling 3.0 gera diálogo com lip sync em cinco idiomas: inglês, chinês, japonês, coreano e espanhol. Além do suporte básico de idioma, o modelo reproduz sotaques e dialetos específicos, incluindo sotaques americano, britânico e indiano para o inglês, e dialetos cantonês, do nordeste, de Pequim, sichuanês e taiwanês para o chinês. Os personagens também alternam entre idiomas no meio de uma conversa dentro do mesmo clipe.

Qual resolução e duração o Kling 3.0 suporta?

A saída vai até 4K nativo, com 1080p e 720p também disponíveis. Cada geração roda entre 3 e 15 segundos. As proporções incluem 16:9 para widescreen, 9:16 para conteúdo vertical de redes sociais e 1:1 para formatos quadrados.

Como consigo melhores resultados com o Kling 3.0?

A maior mudança ao passar de prompt de imagem para prompt de vídeo é descrever movimento, não só aparência. Algumas coisas que melhoram a qualidade do resultado:

  • Comece pela linguagem de câmera. Iniciar o prompt com "travelling handheld" ou "pan orbital lento" define o tom visual de toda a geração.
  • Identifique quem fala em cenas com vários personagens. Ligue cada personagem diretamente ao diálogo dele no prompt para o modelo casar as vozes com os rostos certos.
  • Use o modo multi-shot personalizado quando precisar de controle preciso sobre a duração, o enquadramento e o ângulo de câmera de cada plano.
  • Suba imagens ou vídeo de referência para manter a consistência do personagem. Criar um elemento com traços visuais e de voz vinculados dá ao modelo uma âncora concreta para personagens recorrentes.

No Morphic, você itera rápido, ajustando o prompt e gerando de novo sem sair do espaço de trabalho. Para um passo a passo mais completo com exemplos de prompt, veja o guia completo do Kling 3.0.