Flux 3
de Black Forest Labs
El modelo de mundo de Black Forest Labs para imagen, video y audio, con sonido que encaja con la acción.

Funciones clave
Especificaciones técnicas
5–20s
Segundos completos en una sola pasada, o automático según el prompt
720p / 1080p
HD por defecto, Full HD mediante escalado
T2V·I2V·V2V
Texto, imagen y keyframes, o continuación de un clip existente
Nativo
Audio sincronizado generado con cada clip, activado por defecto
Casos de uso
Video con sonido en una sola pasada
Un prompt entrega el clip y su audio juntos. Un efecto o una línea de diálogo ya quedan sincronizados con la acción, sin agregarlos después.
Secuencias de varios planos
Arma distintos ángulos en una sola generación, o extiende un clip con continuación. El mismo personaje se mantiene en cada corte.
Contenido de marca para redes
Los materiales, el peso y los reflejos se mantienen creíbles mientras se mueve la cámara. Ideal para anuncios y contenido de marca pensado para Reels o TikTok.
Video listo para toda la región
El diálogo multilingüe y el texto en pantalla preciso permiten lanzar una misma escena en varios idiomas, sin una edición de título o doblaje aparte.
Transiciones coreografiadas
Fija las poses y composiciones por las que debe pasar la toma, y el modelo construye el movimiento entre ellas como una sola toma continua.
Explicaciones con física real
La gravedad, los choques y el movimiento siguen reglas reales, así el material educativo o de cómo funciona algo se mantiene preciso y limpio.
Ejemplos de prompts

Clip con física real
Una taza de cerámica resbala de una barra de mármol y se hace pedazos contra el piso. Los fragmentos se dispersan con un golpe seco y sincronizado.
Edit prompt
Secuencia de varios planos
El mismo mensajero con chaqueta roja: en una toma cruza un mercado, en la siguiente llega a una puerta iluminada al anochecer.
Edit prompt
Rótulo localizado
Toma de marca de café, con el vapor subiendo desde una taza recién servida, y el texto en pantalla “Freshly Roasted” en tipografía gruesa y nítida.
Edit prompt
De cámara casera a cine
Metraje de una fiesta de cumpleaños grabado con una cámara casera, y luego la misma escena convertida en un plano cinematográfico cálido, con el ambiente sonoro de fondo.
Edit prompt
Continuación de clip
Ella se aleja de la ventana y sale a la calle de Tokio iluminada por la lluvia, mientras la cámara la sigue sin cortes.
Edit prompt
Producto de estudio
Un tenis de diseño vanguardista gira sobre un pedestal de titanio, con luz dura y reflejos metálicos precisos, y un zumbido mecánico apenas perceptible.
Edit promptOverview
Flux 3 es el modelo de mundo multimodal de Black Forest Labs, anunciado el 23 de julio de 2026. La generación de video llegó a disponibilidad general el 4 de agosto de 2026. Aprende de imagen, video y audio dentro de una sola arquitectura, así que un mismo modelo puede generar una toma en movimiento junto con el sonido que le corresponde, con una comprensión coherente de cómo se ve, se mueve y suena el mundo real.
Qué hace diferente a Flux 3
La mayoría de los generadores tratan cada modalidad como un problema aparte. Flux 3 trata la imagen, el video y el audio como evidencia de una misma realidad. Black Forest Labs entrenó todo junto con su enfoque Self-Flow, y dedicó más del 95 % del cómputo de entrenamiento a la predicción de video. El resultado se nota en la consistencia física: el sonido coincide con el impacto, el movimiento respeta la masa y un personaje mantiene su identidad de una toma a otra. Esa misma comprensión del mundo es la base que permite extender el modelo a la predicción de acciones para robótica, ya probada en tareas de producción real en Audi a través de la alianza FLUX-mimic.
Qué ya está disponible y qué falta
Flux 3 Video es la parte que ya tienes disponible: texto a video, imagen a video con keyframes y continuación de un clip existente, todo hasta 20 segundos y con audio sincronizado. Black Forest Labs también anunció Flux 3 Image para generación y edición de imágenes, Flux 3 Action para robótica, y una versión de peso abierto llamada Flux 3 Dev, además de edición de video y referencias combinadas de imagen, video y audio. Todo eso sigue en el mapa de ruta, no en tus manos todavía.
Flux 3 en Morphic
Flux 3 corre en Morphic junto a otros modelos de video como Veo, Kling, Seedance y Vidu, y al resto de la familia Flux para imágenes. Puedes enviar el mismo prompt a dos modelos dentro del mismo Canvas: es la forma más rápida de descubrir si Flux 3 es la opción correcta para una toma, en vez de confiar solo en la tabla de lanzamiento.
Precios simples
Comienza gratis hoy, con la opción de mejorar tu plan o cancelar cuando quieras.
Basic
1100 mensual créditos
1 usuario
Todos los modelos
Workflows
Standard
3625 mensual créditos
1 usuario
Todos los modelos
Workflows
Pro
6350 compartidos mensual créditos
1 usuario
Todos los modelos
Workflows
Pro Max
24650 compartidos mensual créditos
1 usuario
Todos los modelos
Workflows
Enterprise
Para límites más altos
Personalizado
términos de precios y facturación

Free
Para experimentar
$0
gratis para siempre
Preguntas frecuentes
ChatGPT Images 2.5
OpenAI
El modelo de imagen de OpenAI, de septiembre de 2026. Más detalle, ediciones precisas, más rápido.
Lyria 3.5
Google DeepMind
El mejor modelo musical de Google. Canciones con estructura, voz y letra.
MiniMax H3 Max Turbo
fal.ai
El nivel rápido del H3 afinado por fal. El doble de rápido, casi igual de bueno.
Inworld TTS 2
Inworld
95 voces y más de 100 idiomas. La voz arranca en menos de un segundo.