Generación de video

Bernini

de ByteDance

El modelo de código abierto de ByteDance para ediciones de video con instrucciones, con la identidad intacta.

Bernini

Funciones clave

Especificaciones técnicas

Planner + DiT

Planificador Qwen2.5-VL, renderizador Wan2.2 de 14B

Edit, Generate, R2V

Edición, generación, subject-to-video

480p / 16fps

Configuración de renderizado predeterminada

Apache 2.0

Pesos abiertos, alojable en tu propio hardware

Casos de uso

Mejora material real

Agrega o quita objetos, corrige un detalle o cambia el estilo de un elemento en un clip sin volver a filmar. El bloqueo de consistencia mantiene el resto de la toma idéntico, así que las ediciones se ven naturales.

Personajes recurrentes y avatares

Conserva el mismo rostro en episodios, anuncios o una serie de avatares. Subject-to-video mantiene la identidad de una persona a partir de pocas imágenes de referencia mientras se mueve por escenas nuevas.

Prueba virtual y colocación de producto

Cambia la ropa de un modelo en movimiento a partir de una referencia, o coloca un producto o un video en pantalla dentro de una toma, para trabajos de moda y publicidad que necesitan conservar intacto el clip original.

Reajusta una acción

Cambia lo que alguien hace en una toma, por ejemplo estar de pie se convierte en agacharse, sin volver a filmar. La edición de movimiento modifica la acción mientras la identidad, el encuadre y la iluminación se mantienen fijos.

Ejemplos de prompts

Edición de consistencia

Agrega un muñeco de nieve junto al perro en el camino nevado, y mantén el perro, el camino y los árboles sin cambios

Edit prompt

Sujeto con identidad bloqueada

Coloca a esta persona en la azotea de una ciudad de noche, girando suavemente hacia la cámara, conservando su rostro y su chaqueta

Edit prompt

Intercambio por referencia

Reemplaza la camisa exterior por la de la imagen de referencia, y conserva exactamente la pose, la iluminación y el movimiento

Edit prompt

Precios simples

Comienza gratis hoy, con la opción de mejorar tu plan o cancelar cuando quieras.

Basic

$9/ mes
facturado como $0 por año

900 mensual créditos

1 usuario

Todos los modelos

Workflows

Standard

$24/ mes
facturado como $0 por año

3200 mensual créditos

1 usuario

Todos los modelos

Workflows

Pro

$45/ mes
facturado como $0 por año

6200 compartidos mensual créditos

1 usuario

+ hasta 4 más con costo adicional

Todos los modelos

Workflows

Pro Max

$170/ mes
facturado como $0 por año

24000 compartidos mensual créditos

1 usuario

+ hasta 9 más con costo adicional

Todos los modelos

Workflows

Enterprise

Para límites más altos

Personalizado

términos de precios y facturación

Créditos de alto volumen
Límites de asientos personalizados
Todos los modelos
Workflows
Pricing Gradient

Free

Para experimentar

$0

gratis para siempre

Hasta 20 créditos
Solo 1 usuario
Modelos limitados
Workflows

Preguntas frecuentes

¿Qué es Bernini?
Bernini es el framework unificado de código abierto de ByteDance para generación y edición de video. Combina un planificador semántico basado en MLLM con un renderizador basado en DiT construido sobre Wan2.2, y se lanzó bajo Apache 2.0 en junio de 2026.
¿Qué puede hacer Bernini?
Maneja texto a imagen, edición de imágenes, texto a video, edición de video basada en instrucciones, edición guiada por referencia como cambios de prenda e inserción de video, y subject-to-video, que coloca a una persona o personaje en una escena nueva.
¿En qué se diferencia Bernini de un modelo de video estándar?
La mayoría de los modelos de video generan desde cero. Bernini divide el trabajo, un planificador MLLM decide la semántica y luego el renderizador pinta los píxeles. Ese diseño le da una consistencia sólida en las ediciones, las partes no tocadas de un clip se mantienen congeladas, y una fuerte preservación de identidad en subject-to-video.
¿Bernini es de código abierto?
Sí. El código de inferencia y los pesos del renderizador son públicos bajo Apache 2.0, en GitHub y Hugging Face. Puedes ejecutarlo en tu propio hardware, se recomienda una GPU de clase Hopper, y varias GPU para video.
¿Qué tan bien preserva Bernini la identidad de un sujeto?
La preservación de identidad es su resultado más destacado. En las evaluaciones de subject-to-video de ByteDance, lidera frente a sistemas comparables en similitud facial, y mantiene un rostro reconocible mientras el sujeto se mueve, lo que lo hace ideal para avatares, trabajo de personajes y contenido serializado donde el mismo rostro debe repetirse.
¿Con qué resolución genera video Bernini?
La configuración predeterminada de renderizado es 480p a 16 fps. Esta versión prioriza la fidelidad y la consistencia de la edición sobre la resolución máxima, y es posible usar configuraciones más altas con un mayor costo de cómputo.