Funciones y capacidades de Seedance 2.5
Seedance 2.5 es el modelo de video de nueva generación de ByteDance. Amplía la línea Seedance 2.0 con tomas nativas más largas, muchas más referencias y audio nativo en más de 10 idiomas, sin perder el control de cámara con IA que caracteriza a la línea.
Seedance 2.5 se está desplegando por etapas, así que algunos detalles pueden cambiar antes del lanzamiento completo, previsto por ByteDance para el 7 de agosto de 2026.
| Función | Qué hace | Ideal para |
|---|---|---|
| Video de una sola toma más larga | Mantiene una sola toma continua mucho más allá de unos segundos, hasta 30 segundos | Anuncios, escenas cortas, revelaciones largas |
| Continuidad guiada por referencias | Toma hasta 50 referencias multimodales para fijar un personaje, un set y una paleta | Series, secuencias de varias tomas, trabajo de marca |
| Edición dentro del clip | Cambia un elemento de un clip existente sin volver a generar todo | Corregir una toma, revisiones puntuales |
| Control de cámara con IA y audio | Dirige la cámara en lenguaje simple, con audio nativo en el mismo paso | Tomas dirigidas, escenas con sonido |
| Referencia solo de audio | Una pista de voz, música o efectos de sonido puede dirigir el ritmo, la sincronización con el compás y el lip-sync | Videos musicales, diálogo con lip-sync, voz en off localizada |
Video de una sola toma más larga
El cambio principal es la duración. Seedance 2.5 sostiene una sola toma continua mucho más allá de los clips de pocos segundos que producen la mayoría de los modelos. Así, una revelación completa o una escena corta se resuelve en un solo plano, sin cortes que unir. Escribe el prompt como un movimiento en evolución: describe cómo se desplazan el sujeto y la cámara a lo largo de toda la toma, no un solo fotograma congelado.
Continuidad guiada por referencias
Seedance 2.5 se apoya en referencias multimodales para mantener un aspecto estable. Sube una imagen de un personaje, un producto o un set, y el modelo la conserva a lo largo del clip y de una toma a otra. Acepta hasta 50 entradas de referencia por generación (30 imágenes, 10 clips de video y 10 de audio). Puedes combinar imágenes, clips, audio e incluso modelos blancos simples en 3D, de modo que un equipo fije juntos un personaje, una ubicación y una paleta. Eso es lo que mantiene reconocible una secuencia, en lugar de dejarla cambiar de escena en escena.
Edición dentro del clip y extensión
La edición es puntual, no una regeneración completa. Para un solo cambio en un clip existente, ajusta ese elemento en su lugar y el resto del cuadro permanece igual. Es más rápido que regenerar toda la toma y evita perder una toma que ya te gustó. Puedes señalar un momento por marca de tiempo, así el cambio cae justo donde lo quieres.
| Operación | Qué hace | Ejemplo |
|---|---|---|
| Edición por instrucción | Agrega, quita o cambia contenido con texto, opcionalmente en una marca de tiempo fija | Reemplaza la escena de 0:02 a 0:05, mantén el movimiento y el ritmo |
| Edición por imagen de referencia | Cambia un elemento para que coincida con una imagen provista | Reemplaza la chaqueta por la de la referencia, mantén el resto |
| Agregar un sujeto | Coloca una persona, un objeto o un efecto en el cuadro; el resto queda igual | Agrega un arco de energía en las manos del personaje |
| Quitar un sujeto | Borra un objeto, una marca de agua o un logo, y luego rellena el hueco | Quita el dron y su estela, rellena el cielo |
| Edición de audio | Reemplaza la música, agrega efectos o cambia la voz | Cambia la música de fondo, mantén las imágenes |
| Extender un clip | Continúa hacia adelante, rellena el momento previo o une dos clips | Extiende seis segundos hacia adelante mientras el cielo se oscurece |
La extensión es de alta fidelidad: puede continuar un clip más allá de su último fotograma (hacia adelante), generar el momento previo a su primer fotograma (hacia atrás) o construir una transición entre dos clips que conserve el personaje, el ritmo y el estilo. Tú decides cuántos segundos agregar.
Control de cámara con IA y audio
Los movimientos de cámara se dirigen en lenguaje simple: un lento acercamiento, una toma de seguimiento baja, un retroceso. Así el movimiento se lee como una cámara con intención, no como deriva. El audio nativo se genera en el mismo paso, de modo que una escena puede llegar con el ambiente sonoro o los efectos ya integrados, en lugar de un clip mudo.
Audio nativo y más de 10 idiomas
El sonido se genera en el mismo paso, así que una escena puede volver con voz, música o efectos ya integrados. Novedad en 2.5: una referencia solo de audio permite que una pista de voz, música o efectos de sonido dirija el ritmo, la sincronización con el compás y el lip-sync de la toma. Seedance 2.5 también genera de forma nativa en más de 10 idiomas y sigue las instrucciones con mayor precisión. Puedes describir una escena y localizar su voz en off y sus títulos en tu propio idioma, incluido el español.
Casos de uso de Seedance 2.5
Planos generales de larga toma
Un movimiento ininterrumpido a través de un paisaje, sostenido mucho más allá de unos segundos. Una toma nativa larga cubre toda una revelación sin corte, así que la vista aérea se lee como una sola cámara continua y no como clips unidos.
Primeros planos con detalle de oficio
Manos trabajando, joyería y mecanismos conservan su detalle fino durante todo el movimiento. La generación guiada por referencias mantiene el objeto consistente cuadro a cuadro, así que una toma de inspección cercana se ve nítida en vez de emborronarse.
Deporte y movimiento atlético
Cuerpos rápidos y el peso cambiante se mantienen coherentes a lo largo del clip, con un movimiento que sigue la acción en lugar de emborronarla. Una carrera al amanecer se lee con un ritmo real y una continuidad de movimiento creíble.
Escenas cinematográficas de ciencia ficción
Sets grandes, atmósfera y luz volumétrica le dan escala a una toma. El control de cámara recorre el espacio con intención, así que un interior de hangar se siente montado para una escena y no como un render estático.
Viajes y documental
Vistas amplias y revelaciones lentas terminan limpias en alta resolución, listas para una pantalla grande. Un cruce por el desierto conserva su detalle, desde el grano en primer plano hasta el horizonte lejano.
Conceptos surrealistas e imaginativos
Las escenas imposibles se sostienen porque el sujeto se mantiene consistente durante toda la toma. Una ballena que pasa junto a un buzo conserva su escala y su peso, así que el concepto funciona en vez de desarmarse a mitad del movimiento.
Cómo sacarle el mayor provecho a Seedance 2.5
Seedance 2.5 recompensa un guion de toma claro y el hábito de apoyarse en referencias para la continuidad. Unas cuantas prácticas cubren la mayor parte de la calidad:
- Escribe pensando en una sola toma continua. Describe cómo evolucionan el sujeto y la cámara a lo largo de toda la duración de la toma, no en un solo instante.
- Nombra el movimiento de cámara. Un “lento acercamiento” o una “toma de seguimiento baja” concretos se leen como intención; “cinematográfico” no le dice nada al modelo.
- Fija el sujeto con una referencia. Sube una imagen clara de un personaje, un producto o un set para que el aspecto se mantenga a lo largo del clip en vez de ir cambiando.
- Indica para qué sirve cada referencia. Nombra el personaje, el set y la paleta, así el modelo sabe qué referencia dirige qué parte de la escena.
- Reutiliza las referencias entre tomas. Mantener el mismo conjunto de referencias de un corte a otro es lo que le da consistencia a una secuencia.
- Monta el bloqueo complejo con un whitebox 3D. Una escena simple con modelos blancos, usada como referencia, te permite planear el set y el recorrido de cámara antes de gastar una generación en ello.
- Edita en el lugar, no vuelvas a generar todo. Para una corrección puntual en un clip existente, cambia solo ese elemento en vez de regenerar toda la toma.
- Marca el ritmo con una referencia solo de audio. Adjunta una pista de música o voz y el modelo puede ajustar el ritmo, los compases y el lip-sync a ella.
Elegir referencias para resultados estables
Más referencias no siempre es mejor: un conjunto acotado es lo que sostiene la calidad.
- Con referencias de imagen, mantén los sujetos principales en 8 o menos, y sube a un rango de 9 a 12 solo cuando sea necesario.
- Con una referencia de video o de audio, mantén los sujetos en 5 o menos, y apunta a un clip de 5 a 10 segundos: lo bastante largo para leerse, lo bastante corto para mantenerse limpio.
- Con cinco sujetos o menos, funcionan tanto una vista única como varias vistas; pasados los cinco, prefiere imágenes de vista única, o sube ángulos por separado en vez de una sola imagen combinada.
- Prioriza en este orden: los personajes centrales, luego los productos u objetos clave, luego la escena y, por último, el estilo general.
Para ver la lista completa de funciones y especificaciones, consulta la página del modelo Seedance 2.5.
Guía de prompts para Seedance 2.5
Un buen prompt de video se lee como el guion breve de una toma, no como el pie de una foto. Así el modelo tiene un sujeto, un movimiento y una cámara con los que trabajar, en vez de una imagen fija descrita con palabras. Repasa SPACE antes de enviarlo.
| SPACE | Incluye | Ejemplo |
|---|---|---|
| Subject (sujeto) | Quién o qué aparece en cuadro, descrito de forma concreta | Un escalador solitario con una chaqueta roja |
| Performance (actuación) | El movimiento: qué hace el sujeto y cómo | Se impulsa sobre la cresta, con el aliento empañado |
| Ambience (ambiente) | Escenario, hora del día y luz | Un glaciar al amanecer, con un tono azul frío |
| Camera (cámara) | Tipo de toma más un movimiento | Aérea amplia, con un lento retroceso |
| Extra cues (detalles extra) | Audio, ritmo y transiciones | Fondo sonoro de viento suave, una sola toma continua sin cortes |
Prompts débiles vs. prompts fuertes
Nombra la cámara, el movimiento a lo largo del tiempo y el rol de cada referencia, en vez de dejarlos al azar.
| Enfoque | Débil | Fuerte |
|---|---|---|
| Cámara | Un horizonte de ciudad al atardecer | Toma aérea baja deslizándose sobre un horizonte al atardecer, un solo empuje ininterrumpido hacia una torre iluminada |
| Movimiento en el tiempo | Un escalador en una cresta | Un escalador se impulsa sobre la cresta, se pone de pie y se gira hacia el valle mientras la cámara retrocede |
| Continuidad | Usa estas referencias | El detective de la referencia de personaje cruza la plaza que aparece en la referencia de ubicación |
Errores comunes
- Describir una imagen fija: un modelo de video necesita movimiento a lo largo del tiempo, no una fotografía en palabras.
- Cámara vaga: “cinematográfico” no le dice nada al modelo; nombra la toma y un movimiento concreto.
- Meter una secuencia entera en un solo prompt: mantén una acción clara por toma y usa referencias para dar continuidad entre tomas.
- Dejar las referencias sin etiquetar: indica para qué sirve cada una, o el modelo tendrá que adivinar cuál dirige la escena.

