Fonctions et capacités de Seedance 2.5
Seedance 2.5 est le modèle vidéo nouvelle génération de ByteDance. Il prolonge la gamme Seedance 2.0 sur trois points : des plans natifs plus longs, beaucoup plus de références et un audio natif dans plus de 10 langues. Le contrôle caméra IA qui fait la réputation de la gamme, lui, ne change pas.
Le modèle est en cours de déploiement. Certains détails peuvent encore bouger d'ici son lancement complet, que ByteDance attend le 7 août 2026.
| Fonction | Ce qu'elle fait | Idéal pour |
|---|---|---|
| Vidéo en plan unique plus longue | Tient un plan continu jusqu'à 30 secondes, loin des quelques secondes habituelles | Spots pub, courtes scènes, longues révélations |
| Sortie 1080p native | Rend directement une image complète en 1920x1080, sans upscaling, contre 720p au lancement | Diffusion full HD pour le social, le web et la pub |
| Continuité par références | Verrouille personnage, décor et palette à partir de 50 références multimodales au maximum | Séries, séquences multi-plans, travail de marque |
| Édition dans le clip | Change un élément d'un clip existant, sans re-rendu complet | Corriger un plan, révisions ciblées |
| Contrôle caméra IA avec audio | Dirige la caméra en langage clair et génère l'audio natif dans la même passe | Plans dirigés, scènes avec son |
| Référence audio seule | Une piste de voix, de musique ou d'effets pilote le rythme, la synchro sur les temps et le lip-sync | Clips musicaux, dialogues en lip-sync, voix off localisée |
Vidéo en plan unique plus longue
Le changement phare porte sur la durée. Là où la plupart des modèles rendent des clips de quelques secondes, Seedance 2.5 tient un plan continu bien plus long. Une révélation complète ou une courte scène se joue alors d'un seul tenant, sans assemblage. Écrivez le prompt comme un mouvement unique qui évolue : décrivez comment le sujet et la caméra se déplacent sur tout le plan, plutôt qu'une image figée.
Sortie 1080p native
Seedance 2.5 génère désormais nativement en 1080p, une image complète en 1920x1080 produite directement plutôt qu'upscalée depuis un rendu plus petit, contre le 720p livré au lancement. Les clips sortent donc en full HD, prêts pour le social, le web et la pub, sans étape d'upscaling séparée, avec des contours et des textures plus nets qu'un rendu 720p étiré. Le plan complet de 30 secondes, l'audio natif et les références passent tous en 1080p dans la même passe.
Continuité par références
Pour tenir un rendu stable, Seedance 2.5 s'appuie sur des références multimodales. Fournissez l'image d'un personnage, d'un produit ou d'un décor : le modèle en garde le rendu tout au long du clip, puis d'un plan à l'autre. Il accepte jusqu'à 50 entrées de référence par génération, soit 30 images, 10 clips vidéo et 10 audios. Ces entrées vont de l'image au clip vidéo, du son jusqu'aux simples maquettes 3D blanches. Une équipe verrouille ainsi d'un coup le personnage, le lieu et la palette. C'est à cette condition qu'une séquence reste reconnaissable au lieu de dériver de scène en scène.
Édition et extension dans le clip
L'édition vise un point précis, elle ne relance pas tout. Pour un seul changement sur un clip existant, ajustez l'élément sur place : le reste de l'image ne bouge pas. C'est plus rapide qu'une régénération complète, et vous ne perdez pas un plan qui vous plaît déjà. Un timecode permet en plus de viser un moment donné, pour que le changement ne s'applique que là.
| Opération | Ce qu'elle fait | Exemple |
|---|---|---|
| Édition par instruction | Ajoute, retire ou change du contenu par texte, à un timecode donné si besoin | Remplacer la scène de 0:02 à 0:05, garder le mouvement et le rythme |
| Édition par image de référence | Remplace un élément d'après une image fournie | Remplacer la veste par celle de la référence, garder le reste |
| Ajouter un sujet | Insère une personne, un accessoire ou un effet dans l'image, sans toucher au reste | Ajouter un arc d'énergie dans les mains du personnage |
| Retirer un sujet | Efface un objet, un filigrane ou un logo, puis comble le vide | Retirer le drone et sa trajectoire, reconstituer le ciel |
| Édition audio | Remplace la musique, ajoute des effets ou change la voix | Remplacer la musique de fond, garder les visuels |
| Prolonger un clip | Continue vers l'avant, comble le moment d'avant, ou relie deux clips | Prolonger de six secondes vers l'avant tandis que le ciel s'assombrit |
L'extension travaille en haute fidélité. Elle prolonge un clip au-delà de sa dernière image, vers l'avant. Elle génère aussi le moment qui précède sa première image, vers l'arrière. Elle construit enfin une transition entre deux clips. Dans les trois cas, le personnage, le rythme et le style restent intacts. Vous fixez vous-même le nombre de secondes à ajouter.
Contrôle caméra IA avec audio
Les mouvements de caméra se dirigent en langage clair : un lent travelling avant, un plan bas en travelling, un recul. Le mouvement se lit alors comme une caméra intentionnelle, pas comme une dérive. L'audio natif se génère dans la même passe : une scène peut revenir avec son ambiance de pièce ou ses effets déjà en place, au lieu d'un clip silencieux.
Audio natif et plus de 10 langues
Le son se génère dans la même passe. Une scène revient déjà sonorisée, avec voix, musique ou effets en place. Nouveauté de la 2.5, une référence audio seule suffit à piloter le plan : une piste de voix, de musique ou d'effets sonores impose le rythme, la synchro sur les temps et le lip-sync. Seedance 2.5 génère aussi nativement dans plus de 10 langues et suit les instructions de plus près. Vous décrivez ainsi une scène dans votre propre langue, et vous en localisez la voix off et les titres.
Cas d'usage de Seedance 2.5
Plans d'ouverture longs en plan unique
Un mouvement ininterrompu à travers un paysage, tenu bien au-delà de quelques secondes. Un long plan natif porte toute une révélation sans coupe. Une prise aérienne se lit alors comme une caméra unique et continue, pas comme des clips assemblés.
Gros plans de savoir-faire détaillés
Des mains au travail, des bijoux, des mécanismes : le fin détail tient pendant le mouvement. La génération par références garde l'objet constant d'une image à l'autre. Un plan d'inspection rapprochée reste donc net au lieu de baver.
Sport et mouvement athlétique
Des corps rapides et un poids qui se déplace restent nets sur tout le clip. Le mouvement suit l'action au lieu de la flouter, et un sprint à l'aube retrouve un vrai timing, avec une vraie continuité du geste.
Scènes de science-fiction cinématographiques
De grands décors, de l'atmosphère et une lumière volumétrique donnent de l'ampleur au plan. La caméra traverse l'espace avec intention : un intérieur de hangar paraît mis en scène, pas figé dans un rendu statique.
Voyage et documentaire
De larges panoramas et de lentes révélations finissent proprement en 1080p natif, prêts pour un grand écran. Une traversée du désert garde son détail partout, du grain au premier plan jusqu'à l'horizon lointain.
Concepts surréalistes et imaginatifs
Des scènes impossibles tiennent parce que le sujet reste constant du début à la fin du plan. Une baleine qui dérive devant un plongeur garde son échelle et son poids. Le concept passe, au lieu de s'effondrer en plein mouvement.
Comment tirer le meilleur de Seedance 2.5
Seedance 2.5 récompense deux choses : un cahier de plan clair, et l'habitude de confier la continuité aux références. Quelques pratiques portent l'essentiel de la qualité :
- Écrivez pour un seul plan continu. Décrivez comment le sujet et la caméra évoluent sur toute la durée du plan, et non un instant isolé.
- Nommez le mouvement de caméra. Un « lent travelling avant » ou un « plan bas en travelling » se lit comme une intention, là où « cinématographique » ne dit rien au modèle.
- Verrouillez le sujet avec une référence. Une image nette du personnage, du produit ou du décor suffit à faire tenir le rendu sur tout le clip, sans dérive.
- Dites à quoi sert chaque référence. Nommez le personnage, le décor et la palette : le modèle sait alors quelle référence guide quelle partie de la scène.
- Rejouez les mêmes références d'un plan à l'autre. Une séquence ne tient sa constance que si un même jeu de références passe d'une coupe à la suivante.
- Préparez les mises en place complexes avec une maquette 3D blanche. Passez une scène en modèle blanc simple comme référence : vous posez le décor et la trajectoire de caméra avant de dépenser un rendu.
- Éditez sur place, ne relancez pas. Une correction ciblée sur un clip existant demande de changer cet élément, pas de régénérer tout le plan.
- Pilotez le rythme avec une référence audio seule. Joignez une piste de musique ou de voix : le modèle peut en caler le rythme, les temps et le lip-sync.
Choisir les références pour des résultats stables
Plus de références ne vaut pas mieux. C'est un jeu ciblé qui tient la qualité :
- Avec des images de référence, restez à 8 sujets principaux au maximum. Ne montez à 9–12 que si vous ne pouvez pas faire autrement.
- Avec une référence vidéo ou audio, restez à 5 sujets au maximum. Visez un clip de 5 à 10 secondes : assez long pour être lisible, assez court pour rester propre. Les références vidéo totalisent 30 secondes cumulées, les références audio également.
- Pour éditer une vidéo existante, gardez le clip source sous les 20 secondes. Associez-le à 1 à 5 images de référence, et ne montez à 6–8 que si l'édition l'exige.
- Jusqu'à cinq sujets, une vue unique ou plusieurs vues fonctionnent. Au-delà, préférez des images à vue unique, ou téléversez des angles séparés plutôt qu'une seule image combinée. Des images d'angles séparés tiennent mieux qu'un montage de plusieurs vues dans une même image.
- Priorisez dans cet ordre : les personnages principaux, puis les produits ou accessoires clés, puis le décor, puis le style d'ensemble.
Pour la liste complète des capacités et les spécifications, consultez la page du modèle Seedance 2.5.
Guide de prompts Seedance 2.5
Un bon prompt vidéo se lit comme un bref cahier de plan, pas comme une légende. Le modèle a besoin d'un sujet, d'un mouvement et d'une caméra, pas d'une image fixe mise en mots. ByteDance pose une formule pour cela dans son guide de prompts, et tout le reste de cette page s'appuie dessus.
La formule de prompt Seedance 2.5
Six éléments, dans cet ordre, à retirer selon vos besoins :
| Élément | Ce qu'il couvre | Obligatoire |
|---|---|---|
| Sujet et action | Qui ou quoi se trouve dans le cadre, et ce qu'il fait | Oui, c'est la base |
| Décor et environnement | Lieu, moment, météo, relations spatiales, arrière-plan | Facultatif |
| Style visuel | Lumière, couleur, matières, texture, ambiance générale | Facultatif |
| Mouvement de caméra ou coupes | Cadrage, angle, mouvement, sujet net, transitions | Facultatif |
| Audio | Dialogue, voix, ambiance, effets sonores, musique | Facultatif |
Concrètement, cela donne quatre lignes courtes :
[Subject] performs [primary action or event] in [scene and environment].
The visuals feature [visual style].
Use [shot size, camera angle, camera movement, or cuts].
Audio includes [dialogue, ambience, sound effects, or music].
Un exemple concret :
A ceramic artist finishes a pale blue cup in a studio at dawn, lifts it from
the wheel, and places it in the center of a wooden shelf.
Soft morning light enters through the window. The wet clay has a delicate
sheen, and the workbench remains tidy.
Begin with a medium shot of the wheel-throwing process, slowly push in toward
the cup's surface texture, then cut to a frontal view of the shelf.
Retain the low hum of the pottery wheel, the friction of clay, and subtle
indoor ambience.
Le format d'image, la durée et les autres réglages de génération ne se mettent pas dans le prompt. Vous les définissez sur la page de génération.
Syntaxe pour l'audio, le dialogue et les sous-titres
Le langage courant fonctionne. Mais quatre types de crochets disent à Seedance 2.5 exactement quel genre de son ou de texte vous visez. C'est le moyen le plus économique d'éviter deux ratés : une réplique affichée à l'écran comme un sous-titre, un effet sonore prononcé à voix haute.
| Contenu | Crochet | Exemple |
|---|---|---|
| Musique | ( ) | (Soft, rhythmic piano music plays in the background) |
| Effet sonore | < > | <A bell rings in the distance> |
| Dialogue | { } | {Hello, welcome back.} |
| Sous-titre | 【 】 | 【Chapter One: Departure】 |
Nommez la langue avant toute réplique qui n'est pas en chinois, et répétez-la si le modèle continue de se tromper. L'ordre est toujours le même : la langue, puis la variante régionale ou l'accent, puis le style d'élocution, puis le locuteur, puis la réplique :
Dialogue language: American English. The girl says in natural, conversational
American English: {I thought you weren't coming.}
Ce dernier point compte plus qu'il n'y paraît. Nommez une variante régionale, « anglais authentique de Los Angeles » plutôt que simplement « anglais » : vous obtenez une diction précise au lieu d'une lecture neutre.
Nommer les références et définir leur rôle
C'est sur les références que Seedance 2.5 se démarque des modèles précédents. C'est aussi là que la plupart des prompts faibles échouent. Téléverser une image ne représente que la moitié de l'instruction. Le prompt doit préciser ce que cette image apporte, et ce qu'il faut en ignorer :
@Image 1 defines the ceramic artist's facial features, hairstyle, and dark
green apron. Do not use the image background.
@Image 2 defines the wooden workbench, window placement, and morning light of
the pottery studio. Do not use the people in the image.
@Video 1 defines the pacing of throwing clay with both hands, lifting the cup,
and placing it down. Do not use the person's identity, clothing, or scene.
Trois règles portent l'essentiel de la fiabilité :
- Liez une référence à un sujet à la fois. Écrivez chaque correspondance. Une ligne comme « @Images 1 à 4 définissent respectivement quatre personnages » ne dit jamais quelle image correspond à quel personnage.
- Ajoutez les exclusions. Arrière-plans, figurants et compositions suivent une référence tant que vous ne les écartez pas explicitement.
- Précisez quand plusieurs images représentent une seule chose. Quatre angles de la même lampe demandent une consigne : « les quatre images définissent une seule lampe de bureau pliante, et le résultat ne doit contenir qu'une seule lampe du début à la fin ». Sinon vous obtenez quatre lampes.
Quand une vidéo de référence porte déjà le mouvement et le travail de caméra, nommez seulement les attributs à hériter. Reformuler l'action en mots entre en conflit avec la référence que vous avez jointe.
Diriger de nombreuses références à la fois
Au-delà d'une poignée de références, vous ne décrivez plus : vous distribuez les rôles. Procédez dans l'ordre. Définissez le rôle de chaque référence, associez les sujets, regroupez par type, construisez un profil pour les éléments importants, puis choisissez les références scène par scène.
Le regroupement garde une longue liste lisible :
[Characters]
<Conservator> corresponds to @Image 1. Use only the appearance,
hairstyle, and clothing.
<Registrar> corresponds to @Image 2. Use only the appearance,
hairstyle, and clothing.
Do not interchange their appearances, clothing, actions, or dialogue.
[Props]
<Sample Case> corresponds to @Image 5 and belongs only to <Conservator>.
[Scenes]
<Conservation Lab> references @Image 7. Use only the space,
materials, and lighting.
Un personnage qui revient dans plusieurs scènes mérite un profil unique, qui rassemble toutes ses références et comporte une ligne « à ne pas utiliser ». Sélectionnez ensuite scène par scène : chaque plan ne mobilise que les références dont il a besoin :
Scene 1 | Inspection in the Conservation Lab
Use: <Conservator>, <Sample Case>, <Conservation Lab>, and the
case-opening motion from @Video 1.
Event: <Conservator> opens <Sample Case> at the workbench and
inspects the sample inside.
End state: <Conservator> remains on the inner side of the workbench,
<Sample Case> beside their right hand.
Cinquante références forment un vivier de distribution, pas une liste de courses. Le but est d'aider le modèle à choisir les bons éléments pour le plan en cours, pas de tout faire apparaître à l'écran en même temps.
Plans Seedance 2.5 plus longs, édités et prolongés
Seedance 2.5 est conçu pour la durée, et un plan de 30 secondes ne s'écrit pas comme un plan de cinq secondes. Les modes d'édition et d'extension demandent eux aussi une autre approche : ils travaillent sur un clip que vous avez déjà, pas sur une image vierge.
Écrire une vidéo Seedance 2.5 de 30 secondes
Découpez l'histoire en étapes consécutives. Chaque étape porte exactement un changement principal. Précisez aussi ce qui doit être visible à l'écran quand elle se termine : c'est l'état final qui assure la continuité vers l'étape suivante :
[Generation Goal]
Generate an instructional video showing a flower shop's order-packing process.
[Stage 1]
Initial state: <Florist> stands behind the workbench. Loose stems,
scissors, and wrapping paper lie on the tabletop.
Primary event: <Florist> arranges the stems and trims them to length.
End state: <Florist> holds the bouquet in the left hand, scissors
back on the right of the workbench.
[Stage 2]
Continue from the previous stage: both characters keep the same
identities and clothing.
Primary event: <Store Assistant> unfolds the wrapping paper,
<Florist> places the bouquet inside and ties it.
End state: the wrapped bouquet lies flat in the center of the
workbench, bow facing camera.
[Maintain Consistency]
Keep character identities, clothing, prop ownership, and workbench
orientation consistent.
Rythme et minutage
Les étapes restent la méthode par défaut. Les repères temporels servent à autre chose : une passation, une entrée, une transition ou un temps fort qui doit tomber à un moment précis.
| Schéma | À utiliser pour | Exemple |
|---|---|---|
| Plage horaire | Répartir le rythme sur tout le clip | 0–3 s… 3–7 s… 7–12 s… |
| Point temporel précis | Un temps fort critique | À 5 secondes, la caméra effectue un panoramique rapide à gauche et termine la transition |
| Minutage relatif | Un délai entre deux événements | Trois secondes après que le personnage appuie sur le bouton, les lumières s'éteignent |
Gardez les plages consécutives et sans chevauchement. Ce sont des budgets de temps, pas des points de montage : une action peut retomber légèrement d'un côté ou de l'autre d'une limite. Trop peu de contenu dans une plage laisse le modèle divaguer. Trop de contenu provoque des coupes précipitées ou des événements manqués. Demander trois actions en une seconde ne fonctionne pas.
Éditer un clip existant
Une édition est un correctif, pas un nouveau prompt. Désignez le clip source comme référence unique, précisez la portée du changement, puis listez ce qui ne doit pas bouger :
[Edit Goal]
Edit @Video 1. Only from 4-7 seconds, change the cool blue light on
the right wall to warm orange light.
[Source Video Role]
@Video 1 is the sole editing master. It defines the character, room
layout, actions, composition, camera movement, audio, and event order.
[Edit Scope]
Change only the light color on the right wall and the area it
illuminates. Allow skin tone to respond naturally.
[Content to Preserve]
Keep the character's identity, clothing, expression, position, motion,
room structure, camera movement, dialogue, and ambience from @Video 1.
Remplacer un sujet ajoute un bloc de plus, et c'est celui qu'on oublie le plus souvent. Le remplacement doit hériter de la chronologie de l'original : mêmes apparitions, mêmes mouvements, mêmes occlusions, même sortie, avec le minutage, la trajectoire et la vitesse d'origine. Sans cela, vous obtenez le bon objet dans la bonne image, mais au mauvais rythme. Le remplacement d'arrière-plan suit la même logique, limité à tout ce qui se trouve hors de la silhouette du sujet.
Les éditions audio se traitent à part. Nommez le locuteur ou la catégorie de son, le changement, et ce qui reste : retirer la musique tout en gardant le dialogue, le lip-sync, l'ambiance et les effets tient en une seule instruction.
Prolonger un clip vers l'avant ou vers l'arrière
L'extension greffe de nouvelles images sur une image limite. Décrivez donc cette image avant la nouvelle action. Vers l'avant, la première image de l'extension continue la dernière image de la source. Vers l'arrière, la dernière image de l'extension doit rejoindre la première image de la source :
@Video 1 is the source video to extend forward.
Extend @Video 1 forward. The first frame of the extended segment directly
continues from the last frame of @Video 1. Maintain the same locked-off medium
shot, the paper airplane's position and orientation, the classroom-window
background, the afternoon lighting, and its movement toward frame right.
Then, the paper airplane continues gliding right and exits the frame while the
curtain beside the window sways slightly.
Les extensions vers l'arrière demandent un garde-fou de plus. Précisez quels éléments appartiennent uniquement au clip original. Sans cette précision, des personnages ou des accessoires censés arriver plus tard apparaissent trop tôt dans le segment que vous venez de générer. Et « se raccorder à la vidéo source » ne suffit jamais seul : formulez explicitement la première image de la source comme état final, sinon l'image continue de changer après y être arrivée.
Réglages verrouillés que vous ne pouvez pas modifier
L'édition, l'extension et la génération à partir d'une image de départ verrouillent chacune certains paramètres sur le matériau que vous avez fourni.
| Tâche | Format d'image | Durée |
|---|---|---|
| Édition vidéo | Hérité de la vidéo d'entrée, non modifiable | Héritée, non modifiable, à environ 0,3 seconde près |
| Première image ou première et dernière image | Hérité de la première image | Modifiable |
| Extension vidéo | Hérité de la vidéo d'entrée, non modifiable | Modifiable |
Le piège pratique concerne le travail avec première et dernière image. Donnez le même format aux deux images, sinon la dernière sera étirée pour correspondre à la première.
Direction avancée avec Seedance 2.5
Images clés, storyboards et blocages 3D
Plutôt que de décrire la structure d'un plan, vous pouvez la confier à Seedance 2.5. Quatre méthodes, par ordre croissant de contrôle :
- Première et dernière image. Annoncez dès la première ligne laquelle est la première et laquelle est la dernière, puis décrivez l'action continue unique qui les relie. Traitez chaque ancre séparément : un « ces deux images sont la première et la dernière » regroupé ne lie ni l'une ni l'autre.
- Séquences à images clés multiples. Ouvrez par « utiliser @Image 1 à @Image N comme images clés dans cet ordre », puis donnez l'état clé que représente chaque image. Des images séparées s'alignent mieux que plusieurs images assemblées en grille. Elles contrôlent l'ordre des étapes, elles ne reproduisent pas chaque image.
- Grilles de storyboard. Une grille communique l'ordre des plans et une composition approximative, jamais un détail exact. Restez sous environ 15 cases, travaillez au trait propre et limitez les étiquettes texte. Précisez l'ordre de lecture, et excluez le style de la grille elle-même pour que le trait ne se retrouve pas dans le rendu.
- Blocages 3D. Un blocage grossier porte le minutage : trajectoires, mise en place, mouvement de caméra, points de coupe, changements de lumière et rythme sonore. Associez chaque forme grise à son sujet final, par son nom. Un blocage fin possède déjà des structures complètes : il sert donc à re-rendre matières, personnages, décors et style pendant que la structure et le travail de caméra restent fixes. Retirez-en d'abord les lignes de trajectoire, les axes de coordonnées et les frustums de caméra, sinon ils se retrouvent aussi dans le rendu.
Diriger le jeu et l'émotion
Les mots d'émotion donnent une direction, mais ils laissent le jeu ouvert. Ce qui le précise, c'est de nommer ce qu'un spectateur verrait ou entendrait vraiment : mouvement des yeux, tension des sourcils, mouvement de la bouche, respiration, direction du regard, mouvement des mains. Deux à quatre indices suffisent en général pour un seul basculement émotionnel. Inutile de lister chaque détail du visage.
Le schéma par défaut tient en quatre temps : un déclencheur, une réaction immédiate, un changement progressif, puis l'expression stabilisée :
The overall emotion shifts from [starting emotion] to [ending emotion].
After [triggering event], [subject] first shows [immediate observable reaction].
Then, [eyes, brows, mouth, breathing, gaze, or hand movement] gradually [changes].
Finally, [subject] expresses [target emotion] through [outward behavior].
Pour une émotion qui bascule plusieurs fois, enchaînez-la plutôt sur des événements. Chaque nouvelle chose que le personnage entend ou voit fait avancer le jeu d'un cran.
Le vocabulaire de caméra que comprend Seedance 2.5
Le vocabulaire standard peut aller directement dans le prompt. Côté cadrages, du très grand angle au très gros plan. Côté mouvements : travelling avant, travelling arrière, panoramique, mouvement latéral, suivi, mouvement orbital, plongée caméra, recul en travelling, bascule vers le haut, tremblement à l'épaule. Côté angles : contre-plongée, vue aérienne, vue subjective.
Les techniques populaires fonctionnent aussi, à condition de préciser à quel sujet elles s'appliquent et où le mouvement commence et se termine. Un plan-séquence a besoin des espaces qu'il traverse, dans l'ordre. Pour un dolly zoom, précisez que la taille du sujet reste stable et dans quelle direction l'arrière-plan doit se déplacer. Un bullet time suppose une action figée et une direction d'orbite. Une rampe de vitesse demande où l'action accélère et où elle se stabilise.
Pour un terme que le modèle ne connaît peut-être pas, ou que l'industrie emploie de façon incohérente, gardez le terme et traduisez-le en changement visible :
Rack focus: shift focus smoothly from the leaves in the foreground to the
person in the background. The leaves gradually blur while the person's face
changes from soft to sharp.
L'ouverture, la focale et la vitesse d'obturation sont autorisées. Mais le résultat visible que vous voulez reste presque toujours l'instruction la plus claire.
Liste de vérification avant génération
Passez-la en revue avant de dépenser une génération :
- Le sujet et l'action principale sont énoncés clairement.
- Chaque référence dit ce qu'il faut utiliser et ce qu'il faut ignorer.
- Chaque personnage, produit et accessoire distinct porte un nom et une seule référence.
- Les références sont choisies scène par scène, et non imposées à tous les plans.
- Chaque étape d'une vidéo longue porte un changement principal et un état final clair.
- Le nombre de personnages, les vêtements, la possession des accessoires et les relations spatiales restent constants.
- Les éditions nomment la référence unique, la portée et le contenu à préserver.
- Les émotions et les termes de caméra inhabituels s'accompagnent d'indices observables.
- La première et la dernière image partagent le même format, et chaque image clé n'a qu'un rôle.
- Les extensions ont une image limite vérifiée, une tendance de mouvement et une continuité audio.
Ce que Seedance 2.5 ne fait pas avec précision
À savoir avant de construire un plan là-dessus :
- Les repères temporels allouent du temps aux événements. Ce ne sont pas des points de montage précis à l'image près.
- Une édition augmente les chances que les événements coïncident avec le clip source. Elle ne garantit pas une correspondance image par image.
- Une transition fluide vise la continuité visuelle et audio. Elle ne conserve pas les deux clips source à l'identique, au pixel près.
- Les sous-titres, formules, panneaux et spécifications produit qui doivent être exacts restent un travail de post-production. Générez le plan, incrustez le texte ensuite.
Prompts faibles vs forts
Nommez la caméra, le mouvement dans le temps et le rôle de chaque référence. Rien de tout cela ne doit rester au hasard.
| Point clé | Faible | Fort |
|---|---|---|
| Caméra | Une ligne d'horizon urbaine au crépuscule | Vue aérienne basse glissant sur une ligne d'horizon au crépuscule, une poussée ininterrompue vers une seule tour éclairée |
| Mouvement dans le temps | Un grimpeur sur une crête | Un grimpeur se hisse par-dessus la crête, se lève et se tourne vers la vallée tandis que la caméra recule |
| Continuité | Utilisez ces références | @Image 1 définit le manteau et le visage du détective, ne pas utiliser son arrière-plan. @Image 2 définit l'agencement et la lumière de la place |
Erreurs courantes
- Décrire une image fixe. Un modèle vidéo a besoin de mouvement dans le temps, pas d'une photographie mise en mots.
- Rester vague sur la caméra. « Cinématographique » ne dit rien au modèle : nommez le plan et un mouvement.
- Entasser une séquence dans un seul prompt, sans étapes. Les événements se percutent alors au lieu de se suivre.
- Laisser les références sans étiquette, ou les étiqueter en groupe. Le modèle doit alors deviner laquelle guide la scène.
- Oublier les exclusions, et hériter de l'arrière-plan ou des figurants d'une référence en même temps que du sujet.

