Generación de video

Veo 4

de Google DeepMind

El próximo modelo de video de Google DeepMind.
4K nativo, clips más largos, personajes consistentes en varias tomas y un lenguaje de cámara cinematográfico en un solo prompt.

Veo 4

de Google DeepMind

Funciones clave

Los detalles de capacidades en esta página reflejan las especificaciones de Veo 4 esperadas según la hoja de ruta pública de Google DeepMind, y se actualizan conforme Google publica más detalles de la ficha del modelo.

Especificaciones técnicas

4K native

Salida verdadera en 4K, no escalada desde 1080p

15 to 30s

Clips en una sola pasada, muy por encima de la base de 8 segundos de Veo 3.1

Native, multi-speaker

Diálogo sincronizado, ambiente, efectos y música en una sola pasada

ID-locked

Rostro, vestuario y voz se mantienen en cada corte

Text, image, frames, refs

Control de entrada múltiple heredado de Veo 3.1

SynthID

Marca de agua imperceptible de procedencia de IA en cada clip

Casos de uso

Cortometrajes de varias tomas

Arma una secuencia de 20 a 30 segundos en un solo prompt y mantén el mismo personaje, vestuario e iluminación en cada corte sin reconstruir referencias.

Comerciales de nivel transmisión

El lenguaje de cámara cinematográfico y la salida en 4K nativo son ideales para anuncios de producto hero, donde el movimiento de cámara y la textura tienen que verse bien en una pantalla grande.

Previsualización cinematográfica

Boceta una escena con cobertura real, planos generales, medios y cerrados, antes de comprometerte con un día de rodaje. Los clips más largos acortan el camino de la idea a la previsualización.

Secuencias de videos musicales

Conecta varios momentos con personajes y locaciones consistentes. El audio nativo con varios hablantes hace que el corte encaje en la pista sin mucha posproducción.

Explicaciones educativas

Recorre un proceso en varias tomas conectadas en lugar de un solo clip de 8 segundos. El modo storyboard mantiene la lógica visual estable entre momentos.

Recorridos de arquitectura

Movimientos de cámara continuos y más largos por un espacio con geometría e iluminación estables, ideales para equipos de bienes raíces, interiorismo y diseño industrial.

Ejemplos de prompts

Cortometraje cinematográfico

Un astronauta solitario camina por una llanura roja y polvorienta al atardecer, cámara en mano en ángulo bajo siguiéndolo desde atrás, el viento agita la tela del traje, estilo cinematográfico

Edit prompt

Comercial de marca

Un frasco de perfume de vidrio gira sobre una superficie de mármol oscuro, cámara orbital lenta, luz suave desde arriba, cáusticos refractivos, sensación premium

Edit prompt

Momento de video musical

Una cantante camina por un cruce peatonal de Tokio empapado de lluvia por la noche, reflejos de neón en el suelo mojado, dolly lento hacia adelante, poca profundidad de campo

Edit prompt

Recorrido arquitectónico

Dolly continuo por una casa minimalista de concreto a la hora dorada, sombras largas, partículas de polvo en la luz, ritmo tranquilo

Edit prompt

Explicación educativa

Corte transversal de un corazón latiendo, anatomía precisa, rotación lenta, iluminación suave de estudio, cambios de foco que sugieren señalamientos

Edit prompt

Historia de varias tomas

Plano general de un excursionista llegando a una cresta al amanecer, luego plano medio del mismo excursionista sacando un mapa, luego cerrado de manos curtidas trazando un sendero

Edit prompt

Precios simples

Comienza gratis hoy, con la opción de mejorar tu plan o cancelar cuando quieras.

Basic

$9/ mes
facturado como $0 por año

900 mensual créditos

1 usuario

Todos los modelos

Workflows

Standard

$24/ mes
facturado como $0 por año

3200 mensual créditos

1 usuario

Todos los modelos

Workflows

Pro

$45/ mes
facturado como $0 por año

6200 compartidos mensual créditos

1 usuario

+ hasta 4 más con costo adicional

Todos los modelos

Workflows

Pro Max

$170/ mes
facturado como $0 por año

24000 compartidos mensual créditos

1 usuario

+ hasta 9 más con costo adicional

Todos los modelos

Workflows

Enterprise

Para límites más altos

Personalizado

términos de precios y facturación

Créditos de alto volumen
Límites de asientos personalizados
Todos los modelos
Workflows
Pricing Gradient

Free

Para experimentar

$0

gratis para siempre

Hasta 20 créditos
Solo 1 usuario
Modelos limitados
Workflows

Preguntas frecuentes

¿Qué es Veo 4?
Veo 4 es el modelo de video de cuarta generación de Google DeepMind y el sucesor de Veo 3.1. Genera clips en 4K nativo verdadero de 15 a 30 segundos en una sola pasada, con consistencia de personajes fija entre cortes, secuenciación tipo storyboard, control de cámara cinematográfico y audio sincronizado con varios hablantes. Cada salida lleva la marca de agua SynthID de Google para procedencia de IA.
¿Cuánto duran los videos de Veo 4?
Veo 4 genera clips de aproximadamente 15 a 30 segundos en una sola pasada, un salto importante frente a la ventana de 8 segundos de Veo 3.1. Las escenas más largas se arman encadenando momentos en modo storyboard, lo que mantiene personajes, iluminación y continuidad estables entre cortes.
¿Qué resolución entrega Veo 4?
Veo 4 entrega 4K nativo verdadero (3840×2160) en lugar de escalar desde una resolución menor. La ruta de 4K nativo mantiene intacto el detalle fino en piel, telas, follaje y movimientos pequeños, justo el tipo de detalle que suele romperse cuando el video se escala después de la generación.
¿Cómo uso Veo 4 en Morphic?
Abre Morphic, cambia la barra de prompts a modo Video y elige Veo 4 en el selector de modelos. Agrega un prompt de texto, adjunta imágenes o cuadros de referencia si quieres personajes fijos, y ejecuta la generación. Para escenas de varias tomas, escribe cada momento como un prompt distinto en modo storyboard y Veo 4 devuelve una secuencia conectada.
¿Cómo se compara Veo 4 con Veo 3.1?
Veo 3.1 es el modelo insignia fotorrealista de Google DeepMind en 4K con audio nativo, clips de 8 segundos y movimiento con física precisa. Veo 4 hereda esas fortalezas y avanza en tres puntos: duración de 15 a 30 segundos por clip, consistencia de personajes en varias tomas sin manejar referencias a mano, y un lenguaje de cámara cinematográfico más completo.
¿Cómo se compara Veo 4 con Seedance 2.0?
Seedance 2.0 acepta hasta 12 recursos combinados por generación con sincronización nativa de música y clips flexibles de 4 a 15 segundos. Veo 4 se enfoca en clips individuales más largos, personajes fijos entre cortes, audio de diálogo con varios hablantes y control de cámara cinematográfico. Elige Seedance 2.0 para clips multimodales guiados por música; elige Veo 4 para escenas de varias tomas con diálogo.
¿Cómo se compara Veo 4 con Kling 3.0?
Kling 3.0 destaca en movimiento estilizado y un fuerte desempeño de imagen a video en resoluciones competitivas. Veo 4 destaca en salida verdadera en 4K nativo, audio sincronizado con varios hablantes, personajes fijos en varias tomas y secuenciación tipo storyboard. Para trabajo narrativo largo con diálogo, Veo 4 es la opción más sólida; para experimentos de movimiento estilizado, Kling sigue siendo competitivo.
¿Veo 4 admite consistencia de personajes?
Sí. Veo 4 ancla a los personajes con imágenes de referencia y mantiene rostro, vestuario y voz estables en cada toma de una secuencia. Un sujeto en la primera toma se ve como la misma persona en la décima, sin volver a subir la referencia cada vez.
¿Veo 4 genera audio?
Sí. Veo 4 genera audio nativo sincronizado en la misma pasada que el video: diálogo con varios hablantes, sonido ambiente, efectos y música. El audio fluye entre cortes dentro de un storyboard en lugar de reiniciarse en cada clip, así que una escena de diálogo se ve como una sola toma continua.
¿Veo 4 incluye una marca de agua?
Sí. Cada clip de Veo 4 lleva la marca de agua imperceptible SynthID de Google. La marca de agua es invisible para quien mira el video, está activada por defecto y resiste ediciones comunes como recodificación y cambios de tamaño, para procedencia de IA.