Seedance 2.0 완벽 가이드: 기능, 비교 및 사용법 튜토리얼

전문가를 위한 Seedance 2.0 완벽 가이드. Kling, Veo, Sora와 기능 비교. 고급 기법으로 멀티모달 AI 비디오 마스터하기. Morphic에서 체험하세요.

Seedance 2.0이란?

Seedance 2.0은 이미지, 영상, 오디오, 텍스트 입력을 결합해 전례 없는 창작 제어를 제공하는 ByteDance의 고급 멀티모달 AI 영상 모델입니다. 이 완벽 가이드는 Seedance를 Kling, Veo, Sora와 비교하고, 전문가가 Morphic에서 멀티모달 영상 워크플로를 익히는 방법을 보여줍니다.

글로 쓴 프롬프트에만 의존하는 기존 텍스트 투 비디오 모델과 달리, Seedance 2.0은 원하는 것을 시각·청각 레퍼런스로 AI에게 직접 보여줄 수 있게 합니다. 레퍼런스 이미지를 올려 스타일과 구도를 정하고, 영상 클립으로 원하는 카메라 움직임이나 동작을 시연하고, 오디오로 분위기와 리듬을 잡은 다음, 세밀한 텍스트 프롬프트로 이 모두를 묶어 정확하게 연출합니다.

특정 문제를 더 깊이 다루는 자매 가이드가 둘 있습니다. 연출의 기술을 다루는 시네마틱 Seedance 2.0 영상, 그리고 생성이 거부되어 돌아왔을 때를 다루는 Seedance 2.0 프롬프트가 플래그될 때의 대처법입니다.

전문 영상 제작에 Seedance 2.0을 쓰는 이유

Seedance 2.0은 AI 영상 생성의 근본적인 한계, 즉 설명과 머릿속 그림 사이의 간극을 다룹니다. 복잡한 카메라 움직임, 캐릭터 디테일, 시각 효과를 말로 설명하려 애쓰는 대신 직접 예시를 줄 수 있습니다. 이 멀티모달 접근이 가져다주는 것은 다음과 같습니다.

  • 이미지 레퍼런스를 통한 정밀한 시각 제어
  • 영상 레퍼런스를 통한 정확한 모션 복제
  • 오디오 통합을 통한 리듬과 분위기 동기화
  • 여러 샷에 걸친 캐릭터와 스타일의 일관성
  • 연속성을 유지하는 복잡한 장면 전환

이 모델은 여러 레퍼런스 유형을 동시에 이해하고 결합하는 데 강해서, 상업 제작, 콘텐츠 제작, 전문 영상 워크플로에서 특히 가치가 있습니다.

Seedance 2.0 vs Kling vs Veo vs Sora: 기능 비교

AI 영상 생성 도구를 평가할 때 각 플랫폼의 구체적인 역량을 이해하면 워크플로에 맞는 선택을 하기 쉬워집니다. Seedance 2.0이 주요 대안과 어떻게 비교되는지 보겠습니다.

기능Seedance 2.0Kling 3.0Veo 3.1Sora
멀티모달 입력 지원이미지, 영상, 오디오, 텍스트이미지, 영상, 오디오, 텍스트이미지, 텍스트이미지, 텍스트
최대 영상 길이최대 15초최대 15초최대 8초(60초 이상으로 확장 가능)최대 60초
오디오 통합오디오 파일 직접 업로드 및 참조립싱크와 다국어 대사를 지원하는 네이티브 오디오효과음과 대사를 포함한 네이티브 오디오텍스트 기반 오디오 생성만 가능
영상 레퍼런스 기능모션과 카메라 워크 전면 복제AI 디렉터와 함께 모션·카메라 워크 전면 복제스타일 전이와 레퍼런스 이미지(최대 3장)제한적
최대 출력 해상도4K(10-bit)4K4K1080p

핵심 차별점:

멀티모달 유연성: Seedance 2.0과 Kling 3.0은 영상·오디오 파일 직접 업로드를 포함한 폭넓은 멀티모달 지원을 제공합니다. Veo 3.1은 이미지 레퍼런스(최대 3장)를 지원하지만 오디오는 참조가 아니라 생성됩니다. Sora는 여전히 텍스트와 이미지 중심입니다.

영상 레퍼런스의 깊이: Seedance 2.0과 Kling 3.0은 레퍼런스 푸티지에서 복잡한 카메라 움직임, 안무, 특수 효과를 복제하는 데 강합니다. Kling 3.0의 "AI 디렉터" 기능은 여러 샷의 장면 구성을 자동화합니다. Veo 3.1은 이미지 투 비디오에 집중하며 캐릭터 일관성은 강하지만, 비디오 투 비디오 모션 복제에는 무게를 덜 둡니다.

오디오 역량: Seedance 2.0은 오디오 파일을 직접 올려 분위기를 정밀하게 제어하고 비트에 맞출 수 있습니다. Kling 3.0은 5개 언어에 걸쳐 정확한 립싱크가 되는 다국어 오디오를 네이티브로 생성합니다. Veo 3.1은 오디오를 네이티브로 생성하지만 오디오 파일 레퍼런스는 받지 않습니다. Sora는 텍스트 설명만으로 오디오를 생성합니다.

길이와 확장: 단일 생성 길이는 Sora가 가장 길지만(최대 60초), Veo 3.1의 확장 기능은 클립을 이어 60초를 넘길 수 있습니다. Seedance 2.0과 Kling 3.0은 모두 15초 생성과 확장 기능을 지원합니다.

해상도와 품질: Seedance 2.0은 10-bit 인코딩으로 최대 4K를 출력하며, 색 계조가 보존되어 HDR과 그레이딩 작업에 유리합니다. 순수 해상도만 보면 Kling 3.0, Veo 3.1과 같은 수준이므로, 결정적인 차이는 대개 픽셀 수가 아니라 레퍼런스 제어력입니다.

기존 푸티지 편집: Seedance 2.0은 업로드한 영상을 흉내 낼 대상이 아니라 편집할 대상으로 다룹니다. 클립 안의 요소를 더하고, 지우고, 교체할 수 있고, 앞뒤로 시간을 확장할 수 있으며, 별개의 클립들을 하나로 이어 붙일 수 있습니다. 편집이 곁다리가 아니라 일급 작업이라는 점이, 클라이언트가 이미 승인한 푸티지를 그대로 살려 쓰기 좋게 만듭니다.

어떤 Seedance 2.0 모델을 쓸 것인가

Seedance 2.0은 같은 기능 세트를 공유하면서 품질과 비용에서 갈리는 세 모델의 가족입니다.

모델적합한 용도최대 해상도
Seedance 2.0최고 생성 품질. 4K를 출력하는 유일한 모델4K
Seedance 2.0 Fast최상급 품질이 필요하지 않을 때 속도와 비용의 균형720p
Seedance 2.0 Mini최고의 비용 효율, 대량 반복 작업720p

실무적인 패턴 하나. 프롬프트와 레퍼런스가 잘 먹힐 때까지 Mini나 Fast로 초안을 잡고, 최종본만 풀 Seedance 2.0으로 돌리세요.

2026년 7월 기준 정보입니다. 기능과 제공 여부는 변경될 수 있습니다.

Morphic에서 Seedance 2.0 사용해 보기 →

Seedance 2.0의 주요 기능과 역량

멀티모달 입력 시스템

Seedance 2.0은 서로 조합해서 쓸 수 있는 네 가지 입력 유형을 받습니다.

이미지 입력(최대 9장)

  • 시각적 스타일과 미감의 방향을 정합니다
  • 캐릭터의 외모를 정하고 일관성을 유지합니다
  • 장면의 구도와 프레이밍을 설정합니다
  • 정확한 재현을 위해 제품 디테일을 지정합니다
  • 조명, 컬러 그레이딩, 분위기를 제어합니다

영상 입력(최대 3개 클립, 합산 최대 15초)

  • 특정 카메라 움직임과 촬영 기법을 참조합니다
  • 모션 패턴과 안무를 복제합니다
  • 장면 전환과 편집 리듬을 가져옵니다
  • 특수 효과와 시각 기법을 시연합니다
  • 캐릭터의 동작과 상호작용을 보여줍니다

오디오 입력(MP3 또는 WAV, 최대 3개 파일, 각 2-15초, 합산 최대 15초)

  • 음악으로 분위기와 정서적 톤을 정합니다
  • 리듬과 비트 구조로 속도감을 제어합니다
  • 특정 효과음이나 앰비언스를 더합니다
  • 대사를 위한 목소리 특성을 맞춥니다
  • 화면 변화를 오디오 큐에 동기화합니다

텍스트 프롬프트(자연어)

  • 서사와 이야기의 진행을 이끕니다
  • 레퍼런스에 없는 동작과 움직임을 지정합니다
  • 장면 전환과 타이밍을 설명합니다
  • 레퍼런스를 어떻게 적용할지 분명히 합니다
  • 시각 레퍼런스가 보여주지 못하는 디테일을 더합니다

제한에 관하여: 유형을 합친 총 파일 상한은 없습니다. 상한은 유형별로 존재하고(이미지 최대 9장, 영상 클립 3개, 오디오 파일 3개), 진짜 제약은 상한이 아니라 당신의 절제입니다. ByteDance는 허용치보다 훨씬 적은 레퍼런스를 쓰라고 권합니다. 다만 정말로 지원되지 않는 조합이 하나 있습니다. 텍스트와 오디오만, 그리고 오디오 단독으로는 생성되지 않습니다. 모든 작업에는 텍스트가 필요하고, 오디오는 언제나 시각 레퍼런스와 함께여야 작동합니다.

레퍼런스 이해 구조

Seedance 2.0의 핵심 혁신은 레퍼런스 이해 시스템입니다. 입력을 단순한 스타일 가이드로 취급하는 대신, 모델은 각 레퍼런스에서 특정 요소를 분석하고 뽑아냅니다.

이미지에서: 구도 구조, 얼굴 특징, 사물 디테일, 조명 세팅, 색 관계, 공간 배치, 스타일 특성

영상에서: 카메라의 이동 경로, 움직임의 속도와 가속, 샷 프레이밍의 변화, 피사체의 동작과 타이밍, 특수 효과의 구현, 전환 기법

오디오에서: 리듬과 비트 패턴, 음색과 분위기, 볼륨의 다이내믹, 효과음의 타이밍, 목소리의 특성

이렇게 세분화된 이해 덕분에 각 레퍼런스의 어떤 측면이 생성에 영향을 줄지 정확히 지정할 수 있고, 최종 결과에 대한 정밀한 제어가 가능해집니다.

기본 생성 품질의 향상

멀티모달 기능 외에도 Seedance 2.0은 기초 체력에서 다음을 개선했습니다.

사실적인 물리 표현: 사물과 인물이 진짜 같은 물리로 움직입니다. 옷이 자연스럽게 늘어지고, 액체가 설득력 있게 흐르며, 요소 간 상호작용이 현실의 규칙을 따릅니다.

부드러운 모션: 연속 동작이 급격한 끊김이나 형태가 뭉개지는 아티팩트 없이 흐릅니다. 여러 단계로 이어지는 복잡한 움직임도 끝까지 일관되게 유지됩니다.

정확한 프롬프트 이해: 공간 관계("뒤쪽 배경에"), 순서가 정해진 샷 시퀀스, 여러 피사체가 얽힌 복잡한 상황을 포함해 상세한 지시를 정확히 해석합니다. 정밀한 타임코드는 예외이며, 아래에서 다룹니다.

일관된 스타일 유지: 생성 초반에 자리 잡은 시각 특성이 끝까지 안정적으로 유지됩니다. 캐릭터의 외모, 조명 조건, 예술적 스타일이 장면이 진행되어도 흔들리지 않습니다.

복잡한 동작 수행: 격투 안무, 세밀한 손동작, 말할 때의 표정, 여러 인물이 맞물리는 상호작용 같은 까다로운 시퀀스를 처리합니다.

멀티모달 제어를 직접 경험해 볼 준비가 되었나요? Morphic에서 Seedance 2.0으로 만들기 시작하기 →

기술 사양

항목사양
생성 길이4-15초
출력 해상도480p, 720p, 1080p, 4K(Seedance 2.0). Fast와 Mini는 720p까지
화면비21:9, 16:9, 4:3, 1:1, 3:4, 9:16, 그리고 레퍼런스 이미지에 맞추는 적응형 설정
출력 형식MP4. 4K는 H.265(HEVC) 10-bit로 인코딩
오디오 출력효과음, 대사, 배경 음악 통합 생성
이미지 입력JPEG, PNG, WEBP, BMP, TIFF, GIF, HEIC, HEIF. 각 최대 30MB
영상 입력MP4, MOV(H.264 또는 H.265), 24-60fps, 클립당 2-15초, 각 최대 200MB
오디오 입력MP3, WAV. 파일당 2-15초, 각 최대 15MB

출력 설정에 관해 두 가지만 짚습니다. 2.35:1 옵션은 없으므로 스코프 룩을 원한다면 프롬프트에 2.35:1을 요구하지 말고 21:9를 고르세요. 그리고 4K는 H.265를 쓰기 때문에, 파일 자체는 멀쩡해도 일부 브라우저와 플레이어에서는 바로 미리보기가 되지 않습니다.

Seedance 2.0 입력 사양 이해하기

파일 개수와 길이 제한

생성 품질을 지키면서 연산 자원을 관리하기 위해 Seedance 2.0에는 다음과 같은 입력 제약이 있습니다.

유형별 파일 개수 제한:

  • 이미지: 최대 9개
  • 영상: 최대 3개 클립
  • 오디오: 최대 3개 파일

합산 길이 제한:

  • 영상 레퍼런스: 모든 클립 합쳐 15초
  • 오디오 레퍼런스: 모든 파일 합쳐 15초

클립당 최소 길이(놓치기 쉬운 부분):

  • 모든 레퍼런스 영상 클립은 최소 2초 이상이어야 합니다
  • 모든 레퍼런스 오디오 파일은 최소 2초 이상이어야 합니다
  • 레퍼런스 영상은 24-60fps여야 합니다

유형을 합친 총 파일 상한은 없습니다. 이미지 아홉 장에 영상 셋, 오디오 셋을 함께 넣는 것도 허용됩니다. 그리고 그것은 나쁜 선택입니다. 이유는 다음 섹션에 있습니다.

지원하지 않는 조합: 텍스트와 오디오만, 그리고 오디오 단독으로는 생성되지 않습니다. 오디오에는 언제나 시각 레퍼런스가 함께 있어야 합니다.

생성 결과물 길이: 4-15초.

주어진 자리를 다 채우지 마세요

위의 제한은 목표치가 아니라 천장입니다. ByteDance의 안내는 허용치를 전부 쓰면 결과가 나빠진다고 분명히 말합니다. 레퍼런스가 너무 많으면 모델은 어떤 특징이 우선인지 판단하기 어려워지고, 스타일 충돌과 흐릿한 피사체 식별이 생기며, 결과물이 요청에서 멀어집니다.

권장 구성은 총 4-5개의 소재입니다. 각각이 서로 다른 역할을 맡아야 합니다.

  • 캐릭터 고정(이미지 1-2장): 캐릭터의 외모를 붙잡습니다
  • 장면 톤 설정(이미지 1장): 환경과 스타일을 붙잡습니다
  • 카메라 움직임(영상 1개): 샷의 언어와 리듬을 붙잡습니다
  • 리듬과 분위기(오디오 1개): 감정과 음색을 제어합니다

두 레퍼런스가 같은 역할을 두고 경쟁하고 있다면, 하나가 많은 것입니다. 같은 캐릭터의 이미지를 네 장 올린다고 해서 모델이 그 캐릭터를 네 배 더 확신하지 않습니다. 어떤 이미지를 믿어야 할지 덜 확신하게 될 뿐입니다.

실전 예시: 특정 제품의 외형, 역동적인 카메라 워크, 경쾌한 음악이 필요한 15초 광고라면, 소재 다섯 개면 완결된 브리프입니다.

  • 이미지 2장: 제품의 두 각도
  • 이미지 1장: 원하는 컬러 그레이딩과 조명 스타일
  • 영상 1개: 카메라 움직임 레퍼런스
  • 오디오 1개: 속도감을 잡아 줄 음악 트랙

환경, 분위기, 호흡을 포함한 나머지 전부는 텍스트 프롬프트의 몫입니다.

등장인물에 관한 명확한 한계: 레퍼런스 인물이 넷을 넘어가면 결과의 안정성이 급격히 떨어집니다. 화면에 인원수가 틀리게 나오거나 같은 인물이 중복되기 시작합니다. 여섯 명의 무리가 필요하다면, 먼저 세 명씩 묶은 이미지 두 장을 생성한 다음 그 이미지를 영상의 레퍼런스로 쓰세요.

입력 품질 가이드라인

이미지 레퍼런스:

  • 정확도가 중요할 때는 선명하고 조명이 좋은 사진을 쓰세요
  • 해상도가 높을수록 디테일 재현이 좋아집니다
  • 제품과 사물에는 여러 각도가 도움이 됩니다. 얼굴에는 오히려 해가 됩니다. 아래 헤드샷 규칙을 보세요. 다각도 캐릭터 시트는 여러 사람으로 읽힙니다
  • 심하게 압축되었거나 화질이 낮은 이미지는 피하세요

영상 레퍼런스:

  • 참조하려는 요소가 분명히 보이게 하세요
  • 여러 요소가 섞인 긴 클립보다, 한 가지에 집중한 짧은 클립이 낫습니다
  • 화질이 좋을수록 모션 이해도가 올라갑니다
  • 관련 구간만 남기고 영상을 잘라 내세요

오디오 레퍼런스:

  • 가능하면 배경 소음이 없는 깨끗한 오디오 파일을 쓰세요
  • 원하는 리듬이나 분위기가 분명히 드러나게 하세요
  • 목표 영상 길이와 대략 비슷한 길이로 맞추세요
  • 하나의 파일이 여러 목적을 겸할 수 있다면 영상 파일의 오디오를 쓰는 것도 고려하세요

Seedance 2.0 멀티모달 레퍼런스 사용법

Seedance 2.0은 Morphic을 통해 사용할 수 있으며, Morphic은 레퍼런스를 올리고 프롬프트를 쓰는 인터페이스를 제공합니다. 업로드한 각 파일을 생성에서 어떻게 쓸지 지정하는 데는 @ 멘션 구조를 사용합니다.

먼저, 세 가지 작업 중 무엇을 요청하는지 알아야 합니다

무엇을 쓰기 전에, 모델에게 어떤 일을 시키는지부터 정하세요. 작업마다 표현이 다르고, 이것을 잘못 잡는 것이 생성을 낭비하는 가장 흔한 방법입니다.

  • 멀티모달 레퍼런스: 소재에서 요소(피사체, 스타일, 카메라 무브, 목소리)를 뽑아 완전히 새로운 영상을 만듭니다.
  • 영상 편집: 기존 영상 안의 무언가를 바꿉니다. 언급하지 않은 것은 그대로 남습니다.
  • 영상 확장: 기존 영상을 앞이나 뒤로 이어 갑니다. 스타일, 피사체, 서사는 그대로 유지됩니다.

함정: 편집과 확장 작업에서는 클립을 @Video 1이라고만 부르고, 절대 "reference @Video 1"이라고 쓰지 마세요. reference라는 단어는 모델이 이 작업을 레퍼런스 작업으로 분류하게 만들어, 클립을 편집하는 대신 그것과 비슷해 보이는 새 영상을 생성하게 합니다. "Strictly edit @Video 1" 또는 "Extend @Video 1 backward"라고 쓰고, "Reference @Video 1 and edit it"이라고 쓰지 마세요.

참조하기 전에 피사체를 정의하세요

업로드한 이미지에는 대개 하나 이상의 것이 담겨 있습니다. 피사체를 명시적으로 이름 붙이는 것은 사람들이 가장 많이 건너뛰는 단계이자, 모델이 엉뚱한 요소를 붙잡는 것을 막아 주는 단계입니다.

피사체를 유일하게 식별해 주는 고정적이고 정적인 특징 2-3개(옷, 헤어스타일, 범주)를 고른 다음, 소재에 묶으세요.

@Image 1의 [핵심 특징]을 [피사체 이름]으로 정의한다

예를 들면 이렇습니다. @Image 1에서 빨간 드레스에 밀짚모자를 쓴 여성을 Subject 1로 정의한다. 그 시점부터 그녀는 오직 Subject 1로만 부릅니다. 그녀가 등장할 때마다 같은 이름을 씁니다. "그 여자", "그녀", "Subject 1"을 오가면 모델은 누구를 말하는지 놓칠 수 있습니다.

급한 작업이라면 정의를 생략하고 인라인으로 묶을 수도 있습니다. 언급할 때마다 짝을 반복하면 됩니다. Subject 1@Image 1.

여기서 중요한 규칙이 둘 있습니다. 설명은 짧게, 모순 없이 유지하세요. 같은 피사체에 상충하는 특징 둘이 붙으면 결합이 흐트러집니다. 그리고 공간 관계는 말보다 보여 주기가 쉬울 때가 많으니, 텍스트로 설명하는 대신 레퍼런스 이미지로 보여 주세요.

@ 레퍼런스 시스템

Morphic에 소재를 올린 뒤에는 @ 기호와 파일 식별자(Image 1, Video 1, Audio 1 등)를 붙여 프롬프트에서 참조합니다. 핵심은 각 레퍼런스가 어떤 목적을 수행하는지 명시적으로 말하는 것입니다.

기본 참조 구조:

@[소재 유형 + 번호] as/for [구체적 목적], [추가 맥락]

모호한 참조 vs 명확한 참조:

모호함: "@Image 1과 @Video 1을 써서 영상을 만들어라"

명확함: "@Image 1을 캐릭터의 얼굴이 보이는 첫 프레임으로 사용하고, @Video 1의 카메라 푸시인 움직임을 참조하며, @Audio 1을 경쾌한 분위기의 배경 음악으로 사용한다"

가장 중요한 소재를 맨 앞에 두세요. 프롬프트에서 앞에 나올수록 그 소재의 비중이 큽니다. 캐릭터의 얼굴이 정확해야 한다면 그것부터 쓰세요.

어떤 종류의 정보인지 알려주는 문장 부호

Seedance 2.0은 네 가지 괄호를 유형 신호로 읽습니다. 이를 쓰면 대사가 화면 자막으로 나오거나 효과음이 소리 내어 읽히는 일을 값싸게 막을 수 있습니다.

정보 유형괄호예시
음악( )(배경에 빠른 록 음악이 흐른다)
효과음< ><멀리서 개가 짖는다>
대사{ }{지금 나가야 해요. 당장.}
화면 자막【 】【제1장: 출발】

대사가 영어가 아닌 다른 언어라면 중괄호 앞에 언어를 밝히세요. says in Japanese {こんにちは}. 장면당 한 언어를 유지하세요. 고유명사를 제외하고 한 프롬프트 안에서 언어를 섞으면 발음이 나빠집니다.

효과적인 멀티모달 프롬프트 쓰기: CRAFTS 프레임워크

좋은 Seedance 2.0 프롬프트는 광고 카피보다 엔지니어링 지시서에 가깝습니다. 모델은 텍스트, 이미지, 영상, 오디오를 동시에 읽고 내부적으로 공간 층(프레임 안에 무엇이 있는가)과 시간 층(그것이 시간에 따라 어떻게 변하는가)으로 나눕니다. 당신의 일은 두 층 모두에 깨끗한 재료를 주는 것입니다.

CRAFTS는 완결된 프롬프트가 지정해야 할 여섯 가지를 다룹니다. Context(맥락), Reference(레퍼런스), Action(동작), Framing(프레이밍), Timeline(순서), Style and constraints(스타일과 제약).

C - Context: 장면과 환경 세우기 장소, 시대, 분위기, 전체 세팅으로 무대를 잡습니다. 장면 이미지에 대한 참조도 여기에 넣습니다.

예시: "밤의 조명이 낮은 재즈 클럽 안, @Image 1의 실내 분위기를 참조한다"

R - Reference: 피사체를 정의하고 소재에 묶기 각 피사체를 고정 특징 2-3개로 이름 붙인 다음, 각 소재가 무엇을 제공하고 무엇을 제공하지 않는지 정확히 밝힙니다.

예시: "@Image 2의 회색 정장 남자를 Pianist로 정의한다. @Image 2는 그의 얼굴과 체형에만 사용하고 의상에는 사용하지 않는다. @Video 1은 걷는 속도에 사용한다. @Audio 1은 배경 재즈에 사용한다."

A - Action: 인물과 사물의 움직임 서술하기 장면에서 무슨 일이 벌어지는지 자세히 씁니다. 인물의 동작, 사물과의 상호작용, 사건의 순서입니다. 작동하는 동작 서술과 그렇지 않은 서술을 가르는 것은 두 가지입니다.

작고 느리게 가세요. Seedance 2.0은 격렬한 움직임보다 부드럽고 연속적이며 작은 움직임을 훨씬 안정적으로 처리합니다. 전력 질주, 큰 점프, 거친 구르기에서 팔다리가 뭉개지고 물리가 깨집니다. "천천히 걷는다", "손을 부드럽게 든다", "그 움직임 그대로 앉는다"를 택하세요. 신체 부위와 함께 범위, 속도, 힘을 지정하세요. "그가 머리를 움직인다"가 아니라 "그가 고개를 빠르게 돌린다"입니다. 한 동작이 다음 동작으로 이어질 때는 어떻게 연결되는지 말해서 움직임이 스스로 관성을 갖게 하세요. "몸을 도는 관성을 이용해 자연스럽게 손을 든다".

감정을 신체 디테일로 바깥에 드러내세요. 모델은 "매우 슬픔"을 그리지 못합니다. 슬픔이 몸에 하는 일은 그릴 수 있습니다. 추상적인 이름표를 겉으로 드러나는 신호로 바꾸세요.

이렇게 쓰는 대신이렇게 묘사하세요
슬픔고개를 떨구고, 어깨가 미세하게 떨리고, 눈이 붉어지고, 손가락이 무의식적으로 코트 자락을 움켜쥐고, 눈물이 차오르지만 떨어지지는 않는다
기쁨입꼬리가 참지 못하고 올라가고, 눈썹과 눈매가 풀리고, 걸음이 가벼워지고, 자기도 모르게 흥얼거리고, 제자리에서 도는 것을 참지 못한다
초조함시계를 자꾸 확인하고, 손가락으로 탁자를 두드리고, 숨이 빨라지고, 시선이 자꾸 비껴가고, 손톱을 깨문다
분노두 주먹을 쥐고, 턱에 힘이 들어가고, 가슴이 들썩이고, 시선이 굳고, 이 사이로 말을 밀어낸다
안도긴 숨을 내뱉고, 긴장했던 어깨가 한 번에 내려가고, 옅은 미소가 얼굴에 돌아오고, 먼 곳을 올려다본다

예시: "Pianist가 방을 천천히 가로질러 걸어가 바 앞에 멈추고 잔을 든다. 한 모금 마시고, 문 쪽을 바라볼 때 턱에 힘이 들어가며 손가락이 잔을 세게 움켜쥔다."

F - Framing: 카메라 워크와 촬영 기법 정하기 영화 용어를 써서 샷 유형, 카메라 움직임, 앵글, 전환을 지정하세요. 모델은 표준 카메라 어휘를 잘 이해하고 있으니 그대로 쓰면 됩니다.

예시: "와이드 설정 샷으로 시작해, 인물이 바에 다다를 때 미디엄 클로즈업으로 달리 인하고, 그다음 문 쪽을 바라보는 오버 더 숄더 샷으로 컷한다"

샷 하나에 카메라 무브 하나. 한 샷에 푸시인, 오빗, 팬을 동시에 요구하는 것은 화면을 불안정하게 만드는 가장 빠른 길입니다. 무브가 셋이라면 샷도 셋이어야 합니다.

T - Timeline: 초가 아니라 샷의 순서를 정하세요

이 요소는 대부분의 가이드가, 심지어 이 문서의 이전 판도 틀렸던 부분입니다. 본능적으로 모든 것에 타임스탬프를 붙이고 싶어집니다. 0-4초는 이것, 4-8초는 저것. Seedance 2.0의 정밀 타이밍 지원은 불안정하며, 구간에 정확한 길이를 강요하면 생성이 오히려 망가질 수 있습니다.

대신 샷의 순서를 정하고 호흡은 모델이 찾게 두세요. 사건이 벌어지는 순서대로 샷 1, 샷 2, 샷 3이라고 이름 붙이고, 각 샷을 카메라 무브, 인물 동작, 위치, 소리 순으로 서술하세요.

약한 예: "한 남자가 초조하게 거리를 달리고, 장면은 매우 시네마틱하게 느껴진다."

강한 예:

  • 샷 1: 골목길의 측면 뷰. 남자가 달리기 시작하고 숨이 가쁘다.
  • 샷 2: 그가 과일 가판대를 넘어뜨린다. 카메라가 흔들리며 겁에 질린 그의 얼굴로 밀고 들어간다.
  • 샷 3: 그가 낮은 담을 넘어 사라진다. 카메라가 천천히 물러나 텅 빈 거리에 머문다.

타임스탬프가 금지된 것은 아니고, ByteDance의 예시 프롬프트에도 등장합니다. 다만 모델이 참고할 수도 있는 힌트로 보아야지, 반드시 따라야 할 지시로 보아서는 안 됩니다. 호흡이 정말 중요하다면 믿을 만한 방법은 더 촘촘한 타임코드를 쓰는 것이 아니라, 클립당 샷 수를 줄이는 것입니다.

S - Style and constraints: 실패 경로를 닫기

프롬프트의 마지막 블록은 사람들이 빼먹는 부분이지만, 생각보다 훨씬 많은 일을 합니다. 여기에는 세 가지 역할이 있습니다.

화질: 원하는 마감을 이름 붙이세요. "고화질, 풍부한 디테일, 필름 질감, 자연스러운 색, 부드러운 빛."

스타일: 룩을 이름 붙이세요. 레퍼런스 이미지가 이미 그것을 암시한다고 생각될 때도 이름을 붙이세요. 레퍼런스 사진이 실사인데 애니메이션을 원한다면, 말하지 않는 한 결과는 실사로 되돌아갑니다. "2D 일본 애니메이션 스타일" 또는 "3D 스타일라이즈드 CG"라고 명시하세요.

제약: 아무도 요청하지 않은 아티팩트를 막아 주는 문장들입니다.

  • 자막은 넣지 않는다. 어떤 텍스트나 자막도 생성하지 않는다.
  • 로고를 생성하지 않는다.
  • 워터마크를 생성하지 않는다.

여기서 한계는 솔직하게 말할 필요가 있습니다. 제약 문장은 엉뚱한 자막과 워터마크가 나올 확률을 낮출 뿐, 없애지는 못합니다. 실제로 도움이 되는 것은 둘입니다. 레퍼런스 이미지나 클립에 필요 없는 텍스트가 있다면 업로드 전에 소재에서 텍스트를 지우세요. 그리고 프로젝트가 허락한다면 가로로 생성하세요. 엉뚱한 자막은 세로보다 가로에서 훨씬 덜 나타납니다. 세로 크롭은 나중에 하면 됩니다.

CRAFTS 예시 프롬프트:

CRAFTS 예시 프롬프트

맥락: 1940년대 느와르 탐정 사무실의 밤. 블라인드 그림자가 책상 위로 떨어지고, 조명과 분위기는 @Image 1을 따른다. 레퍼런스: @Image 2는 탐정의 외모(중절모, 트렌치코트)에, @Video 1은 그의 느리고 신중한 걸음 속도에 사용한다. @Image 2에서 중절모와 트렌치코트를 입은 남자를 Detective로 정의한다. 샷 1: 사무실 전체의 와이드 샷. Detective가 화면 왼쪽에서 들어와 책상으로 걸어간다. <나무 바닥을 딛는 발소리.> 샷 2: 카메라가 그와 나란히 트래킹하다가, 그가 책상에서 사진 한 장을 집어 들여다볼 때 클로즈업으로 밀고 들어간다. 샷 3: 그의 손에 들린 사진의 인서트 샷. 샷 4: 카메라가 미디엄 샷으로 물러난다. 그가 사진을 내려놓고 무겁게 숨을 내쉰다. 전체: (@Audio 1의 우울한 색소폰 선율). 자막은 넣지 않는다. 고화질, 필름 그레인, 깊은 그림자를 가르는 따뜻한 실사 조명.

이미지 레퍼런스 기법

시각적 스타일과 미감의 방향 정하기

이미지는 결과물의 전체적인 룩과 느낌을 정합니다. 색 팔레트, 조명 접근, 구도 스타일, 예술적 처리를 정하는 데 쓰세요.

시각적 스타일 방향

@Image 1의 시각 스타일로 비에 젖은 밤거리 장면을 만든다. 젖은 노면의 반사, 상점 창의 불빛, 우울한 블루 마젠타 컬러 그레이딩을 그대로 살린다. 구도는 @Image 2의 수직적인 건축 구성을 따른다. 고화질, 필름 그레인, 자연스러운 색.

여러 샷에서 캐릭터 일관성 유지하기

같은 캐릭터가 등장하는 여러 영상을 생성할 때는, 각 프롬프트에서 같은 캐릭터 이미지를 참조해 외모의 일관성을 유지하세요.

캐릭터 일관성

이 시퀀스 내내 @Image 1의 여성을 등장시키고, 그녀의 얼굴 특징, 헤어스타일, 의상을 정확히 유지한다. 그녀는 @Image 2의 야외 배경에서 시작하고, 이후 장면은 @Image 3의 실내 환경으로 전환된다. 두 장소에서 그녀의 외모는 동일하게 유지된다.

정확한 디테일의 제품 쇼케이스

상업용이나 제품 중심 콘텐츠에서는 여러 각도와 디테일 샷을 레퍼런스로 써서 정확한 재현을 확보하세요.

제품 쇼케이스

@Image 1의 핸드백에 대한 제품 쇼케이스를 만든다. 측면 실루엣은 @Image 2와 일치시키고, 표면 질감과 소재 디테일은 @Image 3을 참조하며, 금속 장식과 잠금장치는 @Image 4와 일치시킨다. 부드럽게 회전하는 카메라 움직임으로 모든 각도를 보여 준다. 조명은 밝고 깨끗하게 해서 섬세한 디테일이 전부 드러나게 한다.

영상 레퍼런스 기법

카메라 움직임과 촬영 기법 복제하기

영상 레퍼런스는 텍스트만으로 설명하기 어려운 카메라 기법을 보여 주는 데 특히 강합니다.

카메라 움직임 복제

@Image 1의 캐릭터를 @Image 2의 복도에 배치한다. @Video 1의 모든 카메라 움직임 효과를 엄격히 따른다. 캐릭터가 걸어갈 때 뒤에서 따라가는 트래킹 샷, 카메라가 앞으로 돌아 나오며 로우 앵글로 잡기, 그다음 오른쪽으로 90도 팬하며 문간을 프레임에 담기. 컷 없이 하나의 연속 샷으로 실행한다.

모션 패턴과 안무 복제하기

춤, 격투 시퀀스, 특정한 움직임 패턴에는 영상 레퍼런스가 프레임 단위의 모션 가이드를 제공합니다.

모션 안무

@Image 1의 무술가가 @Image 2의 수련장에서 동작을 수행한다. 캐릭터는 @Video 1에 나온 발차기 시퀀스를 정확히 실행한다. 뒤돌려차기, 이어서 돌려차기, 마지막으로 공중 회전 발차기. 레퍼런스 동작의 속도, 높이, 유연함을 그대로 맞춘다.

특수 효과와 시각 기법 복제하기

영상 레퍼런스는 파티클 효과, 전환, 합성 기법, 그 밖의 시각 효과를 정확히 재현하도록 시연해 줄 수 있습니다.

특수 효과 복제

@Image 1의 캐릭터가 마법적인 변신을 한다. @Video 1의 파티클 효과를 참조한다. 빛나는 입자가 바닥에서 솟아올라 캐릭터 주위를 휘감고, 밝기가 강해지다가, 입자가 바깥으로 터지며 @Image 2의 변신한 모습이 드러난다.

오디오 레퍼런스 기법

배경 음악 통합과 분위기 설정

오디오 레퍼런스는 음악 선택을 통해 영상의 정서적 톤과 호흡을 정합니다.

배경 음악 통합

@Image 2의 체육관에서 @Image 1의 운동선수가 등장하는 15초짜리 동기부여 피트니스 영상을 만든다. @Audio 1의 에너지 넘치는 음악으로 고양되고 강렬한 분위기를 잡는다. 카메라 움직임은 음악의 몰아치는 리듬에 맞춰 역동적인 푸시인과 이동으로 구성한다.

시각 변화의 비트 동기화

장면 전환, 컷, 화면 변화를 특정 비트에 맞춰 정돈된 프로페셔널한 호흡을 만드세요.

비트 동기화

@Image 1의 캐릭터가 @Audio 1의 음악 비트마다 의상을 바꾼다. 첫 의상은 @Image 2, 첫 비트에서 @Image 3의 두 번째 의상으로 컷, 두 번째 비트에서 @Image 4의 세 번째 의상으로, 세 번째 비트에서 @Image 5의 네 번째 의상으로 바뀐다. 모든 컷은 비트에 정확히 맞아떨어진다. 전환 효과 없이 빠른 컷을 사용한다.

목소리 음색과 대사 매칭

특정한 목소리 특성이 중요할 때는, 원하는 음색이 담긴 오디오나 영상 파일을 참조하세요.

목소리와 대사 매칭

내레이터의 목소리는 @Audio 1의 낮고 권위 있는 음색에 맞춘다. 내레이션 텍스트: "기술로 완전히 달라진 세계에서, 한 사람이 모든 것을 의심하기 시작한다." 레퍼런스와 같은 속도와 극적인 강조로 전달한다.

복합 레퍼런스 예시

상업 제작을 위한 전 입력 유형 결합

예시: 제품 광고

제품 광고

맥락: @Image 1을 환경 레퍼런스로 삼은 미니멀 스튜디오. 흰색 무한 배경, 극적인 사이드 조명. 레퍼런스: @Image 2와 @Image 3은 제품(무선 헤드폰)의 정면과 측면을 보여 준다. @Video 1은 카메라 움직임, 느리게 도는 달리에 사용한다. @Audio 1은 배경 음악에 사용한다. 샷 1: 헤드폰이 프레임 중앙에 떠 있는 와이드 샷. 카메라가 @Video 1의 경로를 따라 그 주위를 천천히 원형으로 돌기 시작한다. 샷 2: 카메라가 계속 도는 동안 헤드폰이 부드럽게 펼쳐진다. <부드러운 기계식 클릭 소리.> 샷 3: 이어컵의 LED가 켜질 때 카메라가 클로즈업으로 밀고 들어간다. <부드러운 전원 구동음.> 전체: (@Audio 1의 경쾌한 전자 음악). 스타일: 고화질, 깔끔한 제품 광고 마감, 선명한 반사, 자연스러운 색. 로고나 워터마크는 생성하지 않는다. 자막은 넣지 않는다.

대사가 있는 다인물 장면

예시: 내러티브 장면

다인물 대사 장면

맥락: 낮의 기업 회의실. @Image 1의 현대적인 실내를 따른다. 큰 창, 긴 테이블. 레퍼런스: @Image 2에서 네이비 정장을 입은 여성을 CEO로 정의한다. @Image 3에서 회색 정장을 입은 남자를 Investor로 정의한다. @Video 1은 화자 사이를 오가는 샷 리버스 샷의 카메라 리듬에 사용한다. @Audio 1은 긴장감 있는 앰비언트 음악에 사용한다. 샷 1: 와이드 샷. CEO와 Investor가 테이블 양 끝에 있다. CEO가 일어서서 단호하게 손짓하며 말한다 {이번 합병이 우리의 유일한 선택입니다.} 샷 2: Investor의 미디엄 샷으로 컷. 그는 팔짱을 끼고 몸을 뒤로 젖히며 무덤덤하게 답한다: {전에도 들었던 말입니다.} 샷 3: CEO의 미디엄 샷으로 컷. 그녀가 턱에 힘을 준 채 무겁게 앉는다. 샷 4: Investor가 일어서는 와이드 샷. 카메라가 그가 창가로 걸어가는 동안 부드럽게 트래킹한다. <단단한 바닥을 딛는 발소리.> 전체: (@Audio 1의 긴장감 있는 앰비언트 음악, 낮게 깔린다). 스타일: 고화질, 차분한 기업 톤, 부드러운 창가 빛. 얼굴은 변형 없이 일관되게 유지된다. 자막은 넣지 않는다.

Seedance 2.0 고급 기능

연속된 서사를 위한 영상 확장

Seedance 2.0은 기존 영상에 이야기를 이어 가는 새 내용을 붙여 확장할 수 있습니다. 양방향으로 작동합니다. 클립 이후에 벌어지는 일도 생성할 수 있고, 그 이전에 있었던 일도 생성할 수 있습니다. 좋은 샷은 있는데 그 샷으로 들어가는 길이 없을 때 특히 쓸모 있습니다.

영상 확장 작동 방식:

  1. 기존 영상을 업로드합니다
  2. 원하는 방향을 말하고, 무슨 일이 벌어지는지 설명합니다
  3. 모델이 전환 프레임을 스스로 추출해 이어지는 부분을 생성합니다

클립은 "reference @Video 1"이 아니라 @Video 1이라고 부르세요. 이것은 편집 작업이며, reference라는 단어는 모델이 당신의 클립을 이어 가는 대신 비슷해 보이는 영상을 만들게 밀어붙일 수 있습니다.

예시: 카페 장면 확장하기

기존 영상: 카페 테이블에 앉아 노트북을 보는 사람의 10초 클립

영상 확장

@Video 1 이후의 내용을 생성한다. 그 사람이 노트북을 닫고 커피잔을 들어 창밖을 바라보며 한 모금 마신 뒤, 잔을 내려놓고 일어선다. 카메라는 미디엄 샷을 유지하며 원본의 구도와 조명을 그대로 지킨다.

원본 푸티지는 다시 생성되지 않으므로, 이미 마음에 드는 부분은 그대로 남습니다. 기본적으로 결과물에는 원본 클립의 끝부분만 실려 나오고 전체가 포함되지는 않습니다. 반환되는 영상에 원본을 포함하고 싶다면 그렇게 요청하세요. "@Video 1을 뒤쪽으로 확장하고, [설명], 그런 다음 @Video 1로 끝낸다."

미리 계획해야 할 두 가지 한계

확장은 정말 쓸모 있지만 티가 나지 않는 기능은 아닙니다. 이 점을 미리 알아 두면 하루를 통째로 날리지 않습니다.

이음매가 튈 수 있습니다. 새 구간이 원본과 만나는 지점에서 작은 튐이나 한 프레임의 되감김이 보일 수 있습니다. 오늘날 이것을 확실히 고쳐 주는 프롬프트는 없습니다. 실질적인 해결은 편집 툴에서 이루어집니다. 모든 이음매에서 앞 클립 끝을 약 6프레임, 뒤 클립 시작을 1프레임 잘라 내세요. 더 좋은 방법은 이음매가 움직임 도중이 아니라 컷 지점에 오도록 클립을 계획하는 것입니다. 그러면 불연속이 설계상 보이지 않습니다.

확장을 연쇄하면 품질이 떨어집니다. 생성된 영상을 다시 확장의 원본으로 넣으면 화질이 저하되고, 손상은 회차를 거듭할수록 쌓입니다. 얼굴에 얼룩덜룩한 색 반점으로 가장 먼저 나타납니다. 체인은 짧게 유지하고, 가진 것 중 가장 화질이 좋은 원본을 넣으세요.

정말로 반복 확장이 필요하다면, ByteDance가 문서로 남긴 기이하지만 효과적인 우회법이 있습니다. 클립을 먼저 화이트 모델 영상으로 변환한 다음 거기서 이어 가는 것입니다. 프롬프트는 대략 이렇습니다. "영상을 흰색 3D 모델로 변환한다. 모든 인물은 순백의 3D 모델이 되고, 색도 텍스처도 그림자도 없으며, 순백 배경, 안정적인 구조, 부드러운 움직임." 색과 텍스처를 벗겨 내면 다음 회차가 이전 회차의 아티팩트를 쌓아 올리는 대신 깨끗한 구조 위에서 작업할 수 있습니다.

확장 모범 사례:

  • 연속성이 가장 좋으려면 확장은 비교적 짧게(5-8초) 유지하세요
  • 원본의 끝과 새 내용을 잇는 동작을 분명하게 설명하세요
  • 그대로 유지되어야 할 요소(카메라 앵글, 조명, 인물 위치)를 언급하세요
  • 원본 영상에 오디오가 있다면, 확장에도 그 오디오 스타일을 참조하세요

영상 융합과 다중 클립 전환

여러 기존 클립 사이를 이어 주는 내용을 생성해 매끄러운 전환을 만드세요.

예시: 두 장소 잇기

기존 영상들:

  • @Video 1: 도심 거리를 걷는 인물(모퉁이에 다가가며 끝남)
  • @Video 2: 같은 인물이 아파트로 들어감(문이 열리며 시작)
영상 융합 전환

@Video 1과 @Video 2 사이를 잇는 5초짜리 전환 구간을 만든다. @Video 1의 끝에 있던 인물이 모퉁이를 돌아, @Video 2의 첫 프레임 배경에 보이는 아파트 외부 계단을 올라가 문 앞에 다다르고 문을 열기 시작한다(@Video 2의 시작으로 연결). 두 레퍼런스 영상에서 인물의 외모, 걷는 속도, 움직임 스타일을 그대로 맞춘다. 조명은 시작의 야외 낮빛에서 끝의 @Video 2 실내 조명으로 전환된다.

이렇게 하면 따로 찍은 두 촬영본을 부드럽게 잇는 다리 클립이 생성되어, 인물과 서사의 연속성이 유지됩니다.

기존 영상 속 인물 교체

카메라 워크, 움직임, 장면 디테일 등 다른 모든 요소를 보존한 채 영상 속 인물이나 피사체만 바꿉니다.

예시: 음악 공연 인물 교체

인물 교체

@Video 1에서 여성 리드 보컬을 @Image 1의 남성 아티스트로 교체한다. 공연 동작은 원본 영상의 것을 정확히 복제한다. 마이크를 다루는 방식, 몸의 움직임, 표정, 밴드와의 상호작용까지 그대로다. 교체된 아티스트는 원본 공연의 타이밍과 에너지를 프레임 단위로 맞춘다. 밴드 멤버, 무대, 조명, 카메라 움직임 등 나머지 요소는 모두 그대로 유지된다.

인물 교체의 활용:

  • 광고 콘셉트에서 서로 다른 모델을 테스트하기
  • 같은 장면을 다른 배우로 바꾼 변형 만들기
  • 기존 푸티지를 새 브랜드 앰배서더로 갱신하기
  • 현지 모델을 써서 지역별 콘텐츠 제작하기

스토리 뒤집기와 서사 변경

시각적·기술적 요소는 유지하면서 기존 영상의 서사 방향이나 결말을 완전히 바꿉니다.

예시: 연애 드라마 반전

원본 영상(@Video 1): 남자가 다리 위에서 여자에게 청혼하고, 여자가 승낙하고, 둘이 포옹하는 로맨틱 장면

스토리 뒤집기

@Video 1의 스토리를 뒤집는다. 장면은 동일하게 시작한다. 남자가 무릎을 꿇고 반지 상자를 연다. 그러나 여자의 표정이 놀란 기쁨에서 충격적인 깨달음으로 바뀐다. 그녀는 고개를 저으며 뒤로 물러선다. 남자의 얼굴은 희망에서 차갑고 계산적인 표정으로 변한다. 그는 천천히 일어서고, 태도는 다정함 대신 위협적으로 바뀐다. 여자가 말한다. "당신은 처음부터 나를 속이고 있었어!" 남자가 얼음 같은 미소로 답한다. "이건 네가 우리 가족에게 갚아야 할 몫이야." 원본의 로맨틱한 포옹 대신 대치로 끝난다. @Video 1의 모든 카메라 앵글과 움직임은 그대로 유지한다.

이 기법으로 기존 푸티지의 촬영 품질과 제작 가치를 그대로 살린 채 서사를 완전히 다른 방향으로 돌릴 수 있습니다.

원테이크 롱 샷

컷 없이 여러 환경을 가로질러 피사체를 따라가는 매끄러운 롱테이크 시퀀스를 만드세요.

원테이크 연속 롱 샷

@Image 1, @Image 2, @Image 3, @Image 4, @Image 5는 달리는 사람을 따라가는 원테이크 트래킹 샷을 묘사한다. 순서: 거리 높이에서 시작(@Image 1). 달리는 사람이 오른쪽에서 전속력으로 프레임에 들어오는 와이드 샷. 카메라가 뒤에서 따라붙어 그가 건물 입구에 다다를 때까지 따라간다(@Image 2). 그가 실내 계단을 뛰어오르는 동안 가까운 거리를 유지하며 계속 트래킹한다(@Image 3). 옥상으로 나오고(@Image 4), 카메라는 여전히 뒤에서 따라간다. 달리는 사람이 옥상 가장자리에 다다른다. 카메라가 앞쪽으로 돌아 나와 마지막 프레임을 잡고, 그다음 크레인으로 올라가 도시 스카이라인을 내려다본다(@Image 5). 카메라: 전체적으로 핸드헬드 느낌의 연속 트래킹. 컷 없음. 긴박함과 사실감을 위한 약간의 흔들림. 환경 사이의 이동은 부드럽게 연결된다. 위의 샷 순서가 호흡을 결정하며, 각 구간을 정해진 초 수에 묶지 않는다.

크리에이티브 템플릿 복제

레퍼런스 영상의 구조, 스타일, 기법을 가져오면서 피사체와 브랜딩만 자신의 것으로 바꿉니다.

예시: 광고 스타일 차용

레퍼런스: @Video 1은 특정한 카메라 기법, 전환, 호흡을 가진 고급 향수 광고입니다

크리에이티브 템플릿 복제

@Video 1의 광고 스타일과 구조를 참조해 고급 시계 광고를 만든다. 같은 카메라 기법을 사용한다. 부드러운 달리 이동, 극적인 조명 리빌, 클로즈업 디테일 포커스, 우아한 호흡. 향수병 대신 @Image 1의 시계를 넣는다. 레퍼런스의 세련된 컬러 그레이딩, 전환 타이밍, 리듬을 유지한다. 환경은 @Image 2처럼 미니멀하고 현대적이어야 한다. @Audio 1의 오케스트라 음악으로 프리미엄한 느낌을 맞춘다.

Seedance 2.0 활용 사례와 예시

이 섹션에서는 산업과 난이도별로 Seedance 2.0의 활용을 보여 줍니다. 각 산업마다 기본, 중급, 고급 예시를 두어 단계적으로 실력을 쌓을 수 있게 했습니다.

광고와 상업 제작

기본: 단일 제품 정적 쇼케이스

시나리오: 이커머스용 간단한 제품 진열

단일 제품 쇼케이스

@Image 1의 스마트워치를 @Image 2의 흰 배경 중앙에 놓는다. 카메라가 제품 주위를 360도로 천천히 돌면서 거리를 일정하게 유지한다. 조명은 강한 그림자 없이 깨끗하고 밝다. 샷 후반부에 워치 화면이 켜지며 시간이 표시된다. @Audio 1의 잔잔한 앰비언트 전자 음악을 사용한다. 자막은 넣지 않는다. 워터마크는 생성하지 않는다.

난이도: 이미지 레퍼런스 하나, 카메라 무브 하나, 사건 하나


중급: 다각도 제품 데모

시나리오: 여러 기능을 보여 주는 테크 제품 시연

다각도 제품 데모

맥락: @Image 1을 조명 레퍼런스로 삼은 깔끔한 스튜디오. 미니멀한 배경에 부드럽고 고른 조명. 레퍼런스: @Image 2(무선 이어버드 정면), @Image 3(측면), @Image 4(열린 충전 케이스). @Audio 1은 배경 음악에 사용한다. 샷 1: 열린 케이스를 내려다보는 오버헤드 샷. 뚜껑이 저절로 닫힌다. <기분 좋은 딸깍 소리.> 샷 2: 정면 3/4 각도. 케이스가 열리고 이어버드가 살짝 떠오른다. <부드러운 휙 소리.> 샷 3: 이어버드 하나가 떠올라 천천히 회전하며 모든 면을 보여 주는 동안 카메라가 밀고 들어간다. 샷 4: 충전 중임을 알리며 깜빡이는 케이스 LED의 클로즈업. 전체: (@Audio 1의 경쾌한 음악). 스타일: 고화질, 깔끔한 광고 마감, 자연스러운 색. 자막은 넣지 않는다. 로고나 워터마크는 생성하지 않는다.

난이도: 여러 이미지, 여러 샷, 다양한 카메라 앵글, 오디오 싱크


고급: 장면 전환이 있는 완성형 광고

시나리오: 여러 장소에서 제품 사용을 보여 주는 15초 라이프스타일 광고

장면 전환이 있는 완성형 광고

맥락: @Image 1과 @Image 2(두 각도)의 무선 헤드폰을 위한 라이프스타일 광고. 레퍼런스: @Image 3의 젊은 직장인을 Commuter로 정의한다(헤드샷). @Image 4는 도심 거리, @Image 5는 체육관에 사용한다. @Video 1은 체육관의 역동적인 카메라 스타일에 사용한다. @Audio 1은 전체를 끌고 가는 음악에 사용한다. 샷 1: 카메라가 @Image 1의 헤드폰을 쓰고 번잡한 거리를 걷는 Commuter 옆을 미디엄 거리에서 트래킹한다. <거리 소음, 빽빽하고 가깝게.> 그녀가 이어컵을 두드리자 거리 소음이 사라지고 음악만 남는다. 샷 2: 비트에 맞춰 컷. 그녀는 이제 밝은 홈 오피스의 책상에서 헤드폰을 쓴 채 화상 통화 중이다. 카메라가 이어컵과 표시등의 클로즈업으로 밀고 들어간다. <음악 아래로 낮게 깔리는 키보드 타이핑 소리.> 샷 3: 비트에 맞춰 @Image 5의 체육관으로 컷. 그녀가 강도 높게 운동해도 헤드폰은 흔들리지 않는다. 카메라가 @Video 1의 스타일을 따라 에너지에 맞춰 움직이다가 와이드 샷으로 물러난다. 전체: (@Audio 1의 음악이 세 장소를 관통한다). 스타일: 21:9, @Image 1의 차분한 현대적 톤에 맞춘 전문 컬러 그레이딩, 고화질. 컷은 비트에 맞춘다. 로고나 워터마크는 생성하지 않는다.

난이도: 이미지 5장, 영상 1개, 오디오 1개. 겹겹의 오디오, 세 장소, 전문 촬영 기법.

이 예시는 권장 소재 범위의 상단에 있고, 홈 오피스는 레퍼런스 이미지 없이 말로만 설명했습니다. 의도적인 절충입니다. 세 장소짜리 광고야말로 모든 것을 사진으로 올리고 싶은 유혹이 가장 큰 지점이자, 그렇게 했을 때 피사체가 흐려지기 시작하는 지점입니다.


소셜 미디어 콘텐츠 제작

기본: 트렌디한 스타일의 퀵컷 영상

시나리오: 인기 전환 효과를 쓴 간단한 소셜 콘텐츠

트렌드 퀵컷 영상

@Image 1의 여성을 Subject 1로 정의한다. Subject 1이 @Image 2의 밝은 배경 앞 화면 중앙에 선다. 샷 1: 그녀가 빠른 손짓을 한다. 그 손짓에 맞춰 같은 위치, 같은 포즈로 @Image 3의 의상을 입은 Subject 1로 점프컷한다. 샷 2: 또 한 번의 손짓, 그리고 같은 위치에서 @Image 4의 의상으로 점프컷. 샷 3: 그녀가 마지막 포즈를 유지하며 미소 짓는다. 전체: (@Audio 1의 경쾌한 음악). 모든 컷이 비트에 맞아떨어진다. 세 의상 모두에서 그녀의 얼굴은 동일하게 유지된다. 자막은 넣지 않는다.

난이도: 여러 이미지 레퍼런스, 비트 동기화, 단순한 전환 효과


중급: 여러 장소를 오가는 스토리 시퀀스

시나리오: 데일리 브이로그 스타일 콘텐츠

여러 장소 스토리 시퀀스

맥락: "하루의 기록" 몽타주. 레퍼런스: @Image 1의 여성을 Creator로 정의한다. @Image 2(아침 카페), @Image 3(코워킹 스페이스), @Image 4(야외 공원). @Video 1은 핸드헬드 카메라 움직임 스타일에 사용한다. @Audio 1은 배경 음악에 사용한다. 샷 1: @Image 2의 카페. Creator가 들어와 카운터에서 주문하고, 커피를 손에 든 채 카메라를 향해 돌아선다. @Video 1의 핸드헬드 스타일. <음악 아래로 낮게 깔리는 카페의 웅성거림.> 샷 2: @Image 3의 코워킹 스페이스. 그녀가 노트북으로 작업하며 타이핑하다가 고개를 들어 카메라를 보고 미소 짓는다. <키보드 타이핑 소리.> 샷 3: 노트북 화면의 클로즈업. 샷 4: @Image 4의 공원, 골든 아워. 그녀가 벤치에 앉아 노트북을 닫고, 일어서서 두 팔을 머리 위로 뻗고, 카메라를 향해 걸어온다. <새소리와 가벼운 바람.> 전체: (@Audio 1의 경쾌한 브이로그 음악). 스타일: @Video 1의 움직임을 따르는 핸드헬드 브이로그 룩, 미디엄 샷과 클로즈업을 섞고, 장소 사이의 컷은 비트에 맞춘다. 고화질, 따뜻하고 자연스러운 색. 자막은 넣지 않는다.

난이도: 여러 장소, 핸드헬드 스타일 레퍼런스, 오디오 레이어링, 인물 중심 콘텐츠


고급: 바이럴 스타일의 복합 시각 효과

시나리오: 트렌드 효과를 쓴 고완성도 소셜 콘텐츠

바이럴 시각 효과 변신

맥락: @Image 4의 도심 배경에서 벌어지는 변신 영상. 레퍼런스: @Image 1의 여성을 Dancer로 정의한다. @Image 2(시작 의상, 캐주얼 스트리트웨어), @Image 3(마지막 의상, 무대 의상), @Video 1(팔 동작과 회전의 안무), @Video 2(파티클 효과 스타일), @Audio 1(음악). 샷 1: 카메라가 Dancer 주위를 천천히 돈다. 그녀는 @Image 2의 스트리트웨어를 입고 가만히 서 있다. 샷 2: 그녀가 @Video 1의 동작으로 두 팔을 든다. 팔이 최고점에 이르는 순간 화면이 디지털 왜곡으로 글리치된다. <강한 글리치 사운드.> 샷 3: @Video 2에 맞춘 파티클 효과가 바닥에서 솟아올라 그녀 주위를 휘감는다. 카메라는 계속 회전한다. <상승하는 휙 소리.> 샷 4: 빛이 번쩍인다. 빛이 사그라들 때 그녀는 @Image 3의 무대 의상을 입고 @Video 1의 안무를 따라 회전 중이다. 샷 5: 그녀가 회전을 마치고 정지 포즈로 착지한다. 카메라가 정면에 자리 잡는다. 그녀 뒤의 환경은 이제 @Image 5의 무대다. <착지의 임팩트음.> 전체: (@Audio 1의 고에너지 음악, 절정을 향해 고조된다). 스타일: 높은 대비, 채도 높은 색, 비트에 동기화된 효과, 고화질. 변신 전후로 그녀의 얼굴은 동일하게 유지된다. 자막은 넣지 않는다.

난이도: 복합 레퍼런스 다수, 정밀한 안무 매칭, 특수 효과 복제, 고급 오디오 싱크, 트렌드 스타일 결합


영화와 엔터테인먼트 제작

기본: 분위기를 잡는 설정 샷

시나리오: 내러티브 콘텐츠의 장면 설정 샷

분위기 설정 샷

밤에 본 @Image 1의 버려진 저택을 담은 시네마틱 설정 샷. 단일 샷: 카메라가 건물 전체와 무성하게 자란 부지를 와이드로 잡았다가, 정문을 향해 천천히 밀고 들어간다. 컷 없이 하나의 연속 움직임. 어둡고 음울한 분위기, 구름을 뚫고 내리는 달빛. 2층의 창 하나에서 희미한 빛이 깜빡이고, 나머지 창은 모두 어둡다. <나무 사이를 지나는 바람.> 전체: (@Audio 1의 불길한 앰비언트 톤). 스타일: 필름룩, 고화질, 깊은 그림자, 차가운 달빛. 자막은 넣지 않는다.

난이도: 이미지 하나, 기본 카메라 움직임, 분위기 조성


중급: 샷 리버스 샷이 있는 대사 장면

시나리오: 전문적인 커버리지를 갖춘 두 인물의 대화

샷 리버스 샷 대사 장면

맥락: @Image 1의 삭막한 환경을 따른 취조실. 머리 위 조명 하나, 금속 테이블, 의자 둘. 레퍼런스: @Image 2의 근엄한 중년 남자를 Detective로 정의한다. @Image 3의 젊은 남자를 Suspect로 정의한다. @Video 1은 샷 리버스 샷의 카메라 리듬에 사용한다. @Audio 1은 긴장감 있는 앰비언트 음악에 사용한다. 샷 1: 테이블에 앉은 두 사람의 와이드 샷. Detective가 두 손을 맞잡고 몸을 앞으로 기울인다. Suspect는 눈을 마주치지 않고 손가락으로 탁자를 두드린다. <금속 의자가 삐걱인다.> 샷 2: Detective의 미디엄 클로즈업으로 컷, 약간 로우 앵글. 눈도 깜빡이지 않고 그가 말한다 {그날 밤 당신이 거기 있었다는 걸 우리는 압니다.} 샷 3: Suspect의 미디엄 클로즈업으로 컷, 약간 하이 앵글. 그의 눈이 잠시 흔들리다가 마음을 다잡는다: {무슨 말을 하는지 모르겠는데요.} 샷 4: 다시 와이드 샷으로 컷. Detective가 테이블 위로 사진 한 장을 밀어 보낸다. Suspect의 눈이 커진다. Detective가 몸을 뒤로 젖힌다. 전체: (@Audio 1의 긴장감 있는 음악, 낮게)와 룸톤. <사진이 금속 위를 미끄러진다.> 스타일: 거칠고 극적인 조명, 고화질, 필름룩. 얼굴은 변형 없이 일관되게 유지된다. 자막은 넣지 않는다.

난이도: 캐릭터 이미지 둘, 특정 카메라 기법 레퍼런스, 대사의 호흡, 심리적 긴장


고급: 복잡한 안무의 액션 시퀀스

시나리오: 특정 무술 안무가 있는 격투 장면

복잡한 안무의 액션 시퀀스

맥락: 해 질 녘 옥상. 환경은 @Image 1을 따른다. 공조 설비, 멀리 보이는 스카이라인, 강렬한 주황빛 하늘. 레퍼런스: @Image 2의 파이터를 Hero로 정의한다(헤드샷). 의상은 @Image 3을 따른다. @Image 4의 세 상대를 Opponents로 정의한다. @Video 1은 격투 안무에 사용한다. 회피, 회전 발차기, 그래플. @Video 2는 카메라 스타일에 사용한다. 액션 주위를 돌고, 타격 순간에 컷. @Audio 1은 음악에 사용한다. 샷 1: 와이드 샷. Opponents가 Hero를 둘러싼다. 카메라가 무리 주위를 천천히 돈다. 바람이 옷자락을 움직인다. 샷 2: Hero의 얼굴 클로즈업. 턱이 굳어 있고 호흡은 고르다. 샷 3: 첫 번째 상대가 달려든다. Hero가 @Video 1의 동작대로 오른쪽으로 피한다. 샷 4: Hero가 @Video 1의 회전 발차기를 실행해 명중시킨다. 카메라가 미디엄 샷으로 발차기를 따라간다. <묵직한 타격음.> 샷 5: 두 번째 상대가 접근한다. Hero가 @Video 1처럼 그래플로 잡고, 돌리고, 던진다. 카메라는 @Video 2의 스타일로 액션 주위를 돈다. 샷 6: 세 번째 상대가 휘두른다. Hero가 슬로 모션으로 그 아래를 파고든다. 샷 7: Hero가 일어서고, Opponents는 그의 주위 바닥에 쓰러져 있다. 카메라가 클로즈업으로 밀고 들어가고, 뒤편의 석양이 그를 실루엣으로 만든다. 전체: (@Audio 1의 음악, 절정을 향해 고조된다), <옥상을 가로지르는 바람, 옷자락의 움직임, 거친 숨소리>. 스타일: 따뜻한 석양 톤, 높은 대비, 필름룩, 고화질. 신체는 해부학적으로 안정적으로 유지되고 팔다리가 변형되지 않는다. 자막은 넣지 않는다.

난이도: 이미지 레퍼런스 4장, 영상 레퍼런스 2개(안무와 카메라 스타일), 오디오 레퍼런스, 복잡한 액션 안무, 슬로 모션.

여기서는 기대치를 솔직하게 잡으세요. 빠르고 충격이 큰 액션은 이 모델에게 가장 어려운 요구이며, 팔다리가 뭉개지고 물리가 무너지는 지점입니다. 이 프롬프트가 발차기를 말로 설명하는 대신 안무 레퍼런스 영상에 기대는 이유가 바로 그것입니다. 동작은 설명하는 것보다 보여 주는 쪽이 훨씬 안정적입니다. 그럼에도 이 한 컷은 여러 번 생성해야 할 것입니다. 특정 샷이 계속 실패한다면, 해법은 대개 형용사를 더하는 것이 아니라 동작을 느리게 하거나 두 샷으로 나누는 것입니다.


전문 워크플로 활용

프로젝트 연속성을 위한 영상 확장

시나리오: 이미 찍어 둔 푸티지에 내용을 덧붙이기

기존 영상: CEO가 현대적인 사무실을 가로질러 걸어가 회의실 문 앞에서 끝나는 8초 샷

연속성을 위한 영상 확장

@Video 1 이후의 내용을 생성한다. 영상 끝의 CEO가 회의실 문을 열고 들어간다. 회의실 내부는 @Image 1의 디자인을 따른다. 큰 테이블, 도시가 내려다보이는 통유리창. @Image 2, @Image 3, @Image 4의 임원 세 명이 이미 앉아 있다가 CEO가 들어오자 고개를 든다. CEO가 테이블 상석으로 걸어가 앉는다. 카메라는 부드러운 트래킹 샷으로 CEO를 따라 문을 통과하고, CEO가 앉은 뒤에는 회의실 전체를 보여 주는 와이드 샷으로 컷한다. @Video 1과 같은 전문적인 컬러 그레이딩과 조명 스타일을 유지한다.

활용: 재촬영 없이 기존 전문 영상 자산에 내용을 덧붙이기


템플릿 기반 대량 콘텐츠 제작

시나리오: 일관된 스타일의 소셜 영상을 여러 편 만들기

마스터 템플릿 프롬프트(Video 1):

템플릿 기반 대량 제작

@Image 2의 흰 배경 앞에서 [@Image 1의 제품]에 대한 제품 쇼케이스를 만든다. 샷 1: 카메라가 제품 주위를 360도 회전한다. 샷 2: 제품 옆에 핵심 기능을 강조하는 그래픽 콜아웃이 나타난다. 샷 3: @Image 3의 로고가 프레임 중앙에 자리 잡는다. 전체: (@Audio 1의 음악). 스타일: 깔끔한 광고 마감, 고화질, 부드럽고 고른 빛. 워터마크는 생성하지 않는다.

변형 프롬프트: @Image 1만 다른 제품으로 바꾸고, 브랜드 일관성을 위해 @Image 2, @Image 3, @Audio 1은 그대로 유지합니다

활용: 제품 카탈로그를 위한 확장 가능한 콘텐츠 제작. 여러 자산에 걸쳐 브랜드 정체성을 유지합니다


다국어 버전 제작

시나리오: 같은 광고의 지역별 변형 만들기

기본 프롬프트:

다국어 버전 제작

@Video 1의 30초 광고 구조를 따른다. 내레이션은 @Audio 1의 톤과 속도에 맞춘 [언어] 음성으로 교체한다. @Image 1의 캐릭터는 그대로 유지한다. 화면 텍스트는 @Video 1의 타이밍에 맞춰 [언어] 버전으로 바꾼다.

활용: 일관된 시각 브랜딩을 유지하면서 현지화된 버전이 필요한 글로벌 마케팅 캠페인

Seedance 2.0 모범 사례

CRAFTS 프롬프트 프레임워크(상세)

Seedance 2.0에서 전문가급 결과를 내려면 구조화된 프롬프트 설계가 필요합니다. CRAFTS 프레임워크는 중요한 요소가 빠짐없이 지정되도록 체계적인 접근을 제공합니다.

C - Context: 장면과 환경 세우기

동작이 언제 어디서 벌어지는지 정의합니다. 여기에는 다음이 포함됩니다.

  • 물리적 장소와 세팅
  • 시간대 또는 역사적 시대
  • 대기 조건(날씨, 빛의 성질)
  • 전체적인 무드와 톤
  • 이야기에 중요한 환경 디테일

예시: "새벽 2시의 지하 나이트클럽, @Image 1의 음울한 분위기를 따른다. 스모크 머신의 뿌연 공기, 바의 불빛이 비추는 낮은 천장, 배경에는 사람으로 가득한 댄스 플로어."

R - Reference: 피사체를 정의한 뒤 @ 멘션과 정확한 목적 지정하기

멀티모달의 힘이 사는 곳입니다. 먼저 피사체를 이름 붙이고, 각 레퍼런스가 무엇을 제공하는지 분명히 하세요.

  • 각 피사체를 고정 특징 2-3개로 정의하고, 그 이름을 매번 다시 쓰세요
  • @ 멘션을 분명히 밝히세요
  • 그 레퍼런스의 어떤 측면을 쓸지 정확히 지정하세요
  • 레퍼런스에 여러 요소가 들어 있다면 무엇을 쓰지 않을지도 밝히세요
  • 가장 정확해야 하는 소재를 맨 앞에 두세요

예시: "@Image 1에서 삭발한 머리에 가죽 재킷을 입은 여성을 Ada로 정의한다. @Image 1은 Ada의 얼굴 특징과 머리에만 사용하고 의상에는 사용하지 않는다. @Image 2는 가죽 재킷 의상에 사용한다. @Video 1은 걷는 속도와 당당한 보폭에 사용한다. @Audio 1은 전자 배경 음악에 사용한다."

A - Action: 인물과 사물의 움직임 서술하기

장면에서 무슨 일이 벌어지는지, 즉 영상의 동사를 자세히 씁니다.

  • 인물의 움직임과 제스처
  • 사물과의 상호작용(집기, 내려놓기, 던지기)
  • 표정과 감정적 반응
  • 여러 피사체 사이의 상호작용
  • 물리 기반 사건(떨어지는 것, 쏟아지는 액체, 피어오르는 연기)

예시: "캐릭터가 화면 왼쪽에서 @Video 1의 당당한 보폭으로 걸어 들어온다. 시선이 잠시 군중을 훑다가 화면 밖 누군가에게 고정된다. 옅은 미소가 번진다. 오른손으로 재킷 깃을 매만지고, 목적을 가진 걸음으로 군중 사이를 헤치고 나아가기 시작한다."

F - Framing: 카메라 워크와 촬영 기법 정하기

정확한 촬영 용어로 샷 구성을 지정하세요.

  • 샷 유형: 와이드 샷, 미디엄 샷, 클로즈업, 익스트림 클로즈업, 오버 더 숄더, POV
  • 카메라 움직임: 달리 인/아웃, 트래킹 샷, 팬 좌/우, 틸트 업/다운, 크레인 업/다운, 핸드헬드, 스테디캠
  • 앵글: 로우 앵글, 하이 앵글, 아이 레벨, 더치 앵글
  • 특수 기법: 히치콕 줌, 휩 팬, 랙 포커스, 얕은 심도

예시: "나이트클럽 전체를 담은 와이드 샷으로 연다. 캐릭터가 들어오면 카메라가 따라붙어 미디엄 샷으로 나란히 트래킹한다. 캐릭터가 멈춰 군중을 훑을 때 미디엄 클로즈업으로 천천히 밀고 들어간다. 군중 너머를 바라보는 캐릭터의 POV 샷으로 컷. 미소가 번지는 캐릭터의 얼굴 클로즈업으로 다시 컷. 캐릭터가 군중 사이를 나아갈 때 뒤에서 따라가는 트래킹 샷을 재개한다."

T - Timeline: 샷의 순서를 정하고 호흡은 모델에게 맡기기

시퀀스를 사건이 벌어지는 순서대로 번호를 매긴 샷으로 나누세요.

  • 샷 1, 샷 2, 샷 3으로 이름 붙이되 중요한 것을 앞에 두세요
  • 각 샷에는 카메라 무브 하나, 동작 한 박자, 장소 하나만 두세요
  • 그 샷의 소리는 그 샷 안에 넣으세요
  • 각 샷에 길이를 부여하지 마세요

정밀한 타이밍은 이 모델에서 가장 약한 제어 수단입니다. 구간을 정확한 초 수에 묶으면 그대로 두는 것보다 결과가 나빠질 수 있으니, 사건의 순서를 쓰고 모델이 숨 쉴 여지를 남기세요.

예시: "샷 1: 클럽의 와이드 샷. Ada가 들어와 걷기 시작한다. 샷 2: 그녀가 군중을 훑는 동안 카메라가 미디엄 샷으로 나란히 트래킹한다. 샷 3: 옅은 미소가 번지는 클로즈업. 샷 4: 군중 너머를 바라보는 그녀의 POV. 샷 5: 그녀가 앞으로 나아갈 때 카메라가 뒤에서 트래킹을 재개한다. 전체: (@Audio 1의 전자 음악, 중간 볼륨)."

S - Style and Constraints: 룩을 고정하고 아티팩트를 차단하기

모든 프롬프트를 마감과 가드레일로 닫으세요.

  • 화질: "고화질, 풍부한 디테일, 필름 질감, 부드러운 빛"
  • 스타일: 레퍼런스 이미지가 암시하더라도 명시적으로 이름 붙이세요
  • 제약: "자막은 넣지 않는다." "워터마크를 생성하지 않는다." "로고를 생성하지 않는다."
  • 안정성: "캐릭터의 얼굴은 변형 없이 일관되게 유지된다. 움직임은 끊김이나 깜빡임 없이 부드럽다."

CRAFTS 전체 예시: 기업 교육 영상

CRAFTS 예시: 기업 교육 영상

맥락: 아침의 현대적인 회의실, 화면 오른쪽에서 들어오는 자연광. 환경은 @Image 1의 실내를 따른다. 유리벽, 현대적인 가구, 벽에 걸린 스크린. 레퍼런스: @Image 2의 네이비 블레이저를 입은 여성을 Trainer로 정의한다. @Image 3은 테이블에 둘러앉은 교육생 그룹에 사용한다. @Video 1은 설명할 때 Trainer의 손짓과 몸짓에 사용한다. 샷 1: 모서리에서 방 전체를 잡는 와이드 샷. 테이블 상석의 Trainer와 그 주위의 교육생들을 보여 준다. 샷 2: 정면 3/4 각도에서 잡은 Trainer의 미디엄 샷. 그녀가 스크린을 가리킨 뒤 열린 미소로 그룹을 향해 돌아선다. 샷 3: Trainer 뒤에서 잡은 오버 더 숄더 샷. 듣고 있는 교육생들이 보인다. 한 명이 몸을 앞으로 기울인다. 샷 4: Trainer가 테이블을 따라 걸으며 눈을 맞추는 동안 카메라가 나란히 트래킹한다. 샷 5: 필기하는 교육생의 클로즈업. <조용한 키보드 소리.> 샷 6: 상석으로 돌아온 Trainer의 미디엄 샷. 자신 있는 손짓으로 마무리한다. 전체: (@Audio 1의 기업용 배경 음악, 조용하게, 대사 아래로 낮아진다). 스타일: 고화질 기업 다큐멘터리 룩, 따뜻한 중성 톤, 부드러운 빛. 얼굴은 변형 없이 일관되게 유지되고 움직임은 부드럽다. 자막은 넣지 않는다. 로고나 워터마크는 생성하지 않는다.

입력 준비 전략

이미지 레퍼런스 최적화

좋은 입력이 좋은 출력을 만듭니다. 이미지 레퍼런스를 전략적으로 준비하세요.

캐릭터 일관성을 위해:

  • 정면에서 찍은 얼굴 중심의 헤드샷을 쓰세요. 무표정, 배경은 최소한으로
  • 의상과 비율을 위해 전신 사진 한 장을 더하세요. 그것으로 끝입니다
  • 각도를 더 추가하지 마세요. 정면/측면/3/4 턴어라운드는 정체성 흔들림을 개선하기는커녕 악화시킵니다. 모델이 각 각도를 다른 사람으로 읽기 때문입니다
  • 모델을 헷갈리게 할 강한 필터나 효과는 피하세요
  • 의상이 중요하다면 디테일 크롭을 더하는 대신 전신 사진이 그 역할을 하게 두세요

스타일과 미감을 위해:

  • 원하는 시각적 처리를 분명히 보여 주는 이미지를 고르세요
  • 컬러 그레이딩이 최종 비전과 일치하는지 확인하세요
  • 원하는 조명 방식이 드러난 이미지를 포함하세요
  • 질감과 디테일 수준을 고려하세요. 디테일이 풍부한 레퍼런스가 디테일이 풍부한 결과를 만듭니다

제품과 사물을 위해:

  • 집중을 위해 단순한 배경에서 촬영하세요
  • 정확한 재현을 위해 여러 각도를 보여 주세요
  • 중요한 디테일(로고, 질감, 특징적 요소)의 클로즈업을 포함하세요
  • 조명이 형태와 입체감을 분명히 드러내게 하세요

영상 레퍼런스 최적화

카메라 움직임을 위해:

  • 복제하려는 카메라 무브만 남기고 영상을 잘라 내세요
  • 그 움직임이 동작에 가려지지 않고 분명히 보이게 하세요
  • 여러 기법이 섞인 긴 클립보다, 한 기법에 집중한 짧은 클립(3-5초)이 낫습니다
  • 가능한 가장 좋은 화질의 영상을 쓰세요. 압축 아티팩트가 이해도를 떨어뜨립니다

모션과 안무를 위해:

  • 동작이 가려지지 않고 분명히 보여야 합니다
  • 조명이 몸의 위치와 움직임을 충분히 드러내게 하세요
  • 같은 동작의 여러 각도가 있다면 도움이 될 수 있습니다
  • 레퍼런스 클립을 만들 때 빠른 동작은 느리게 하는 것을 고려하세요

특수 효과를 위해:

  • 복제하려는 효과만 분리하세요
  • 효과가 배경 위에서 분명히 보이게 하세요
  • 효과에 특정한 타이밍이 있다면 그 타이밍도 레퍼런스에 담으세요

오디오 레퍼런스 최적화

음악과 리듬을 위해:

  • 고품질 오디오 파일을 쓰세요(비트레이트가 낮은 압축 오디오는 피하세요)
  • 가장 관련 있는 리듬이나 분위기가 담긴 구간만 남기고 잘라 내세요
  • 원하는 것(비트, 속도, 무드)이 분명히 드러나게 하세요
  • 동기화를 쉽게 하려면 강한 비트에서 오디오를 시작하는 것도 고려하세요

목소리와 대사를 위해:

  • 배경 소음이 적은 선명한 녹음을 쓰세요
  • 원하는 발성 특성이 두드러지게 하세요
  • 레퍼런스 클립은 짧게, 관련 있는 음색에 집중해서 유지하세요

소재 네다섯 개 고르기

유형을 합친 총 파일 상한이 없으므로 이미지 아홉 장을 올리는 것을 아무도 막지 않습니다. 규율은 당신에게서 나와야 합니다. 무엇이 한 자리를 차지할 자격이 있는지 다음 기준으로 정하세요.

네 가지 기능적 역할. 완결된 브리프에는 보통 각각 하나씩 필요하고, 그 이상은 드뭅니다.

  1. 캐릭터 고정(이미지 1-2장): 피사체가 누구인지 붙잡습니다
  2. 장면 톤 설정(이미지 1장): 환경과 스타일을 붙잡습니다
  3. 카메라 움직임(영상 1개): 샷의 언어와 리듬을 붙잡습니다
  4. 리듬과 분위기(오디오 1개): 감정과 음색을 붙잡습니다

나머지를 쳐내는 네 가지 질문:

  1. 이 레퍼런스를 빼면 결과가 실제로 달라지는가? 아니라면 빼세요.
  2. 이것을 텍스트로 말할 수 있는가? 환경, 무드, 컬러 그레이드는 대개 가능합니다. 얼굴, 정확한 카메라 무브, 특정 안무는 대개 불가능합니다. 설명하기 어려운 것을 올리고, 나머지는 전부 설명하세요.
  3. 다른 소재가 이미 이 역할을 하고 있는가? 같은 역할을 두고 경쟁하는 레퍼런스 둘은 하나보다 나쁩니다.
  4. 이것이 필수인가, 있으면 좋은 것인가? 있으면 좋은 것부터 쳐내세요.

결정 과정 예시

뮤직비디오를 만들고 있고 후보 레퍼런스가 열다섯 개 있다고 합시다.

  • 이미지 4장: 여러 각도에서 찍은 아티스트
  • 이미지 3장: 공연 장소
  • 이미지 2장: 조명 세팅
  • 영상 2개: 댄스 안무와 카메라 움직임
  • 오디오 2개: 음악 트랙과 앰비언트 사운드
  • 이미지 2장: 의상 디테일

프레임워크 적용:

  • 남김(캐릭터 고정): 아티스트의 헤드샷 1장과 전신 사진 1장. 네 각도 세트는 아닙니다. 다각도 시트는 모델이 여러 사람을 보고 있다고 착각하게 만드는 가장 확실한 방법입니다
  • 남김(장면): 가장 대표성 있는 공연장 이미지 1장
  • 남김(카메라): 영상 1개. 안무 클립과 카메라 움직임 클립 중, 글로 옮길 수 없는 쪽을 고르세요
  • 남김(리듬): 음악 트랙
  • 텍스트로 설명: 조명 세팅 둘, 의상 디테일, 앰비언트 오디오, 그리고 나머지 공연장 이미지 두 장

결과: 소재 5개. 나머지 열 개의 정보도 여전히 모델에 도달합니다. 파일이 아니라 말로 도착할 뿐이고, 그것이 바로 그 정보들이 있어야 할 자리입니다.

여러 샷 프로젝트를 위한 일관성 기법

여러 생성에 걸친 캐릭터 일관성

여러 번의 영상 생성에서 같은 캐릭터의 외모를 유지하려면 레퍼런스를 체계적으로 관리해야 합니다.

헤드샷 하나와 전신 사진 하나. 그 이상은 쓰지 마세요.

이 모델에서 가장 직관에 어긋나는 규칙이고, 이것을 틀리면 애초에 해결하려던 문제가 바로 그대로 발생합니다.

본능적으로는 캐릭터 턴어라운드, 즉 정면, 측면, 3/4, 후면을 주고 싶어집니다. 그러지 마세요. Seedance 2.0은 다각도 시트를 여러 명의 다른 사람으로 읽는 경우가 잦습니다. 그러면 정체성 흔들림이 개선되기는커녕 악화되고, 같은 캐릭터의 똑같은 복제 둘이 한 프레임에 나오는 "쌍둥이" 버그의 주된 원인이 됩니다.

작동하는 것은 역할이 명확히 나뉜 이미지 두 장입니다.

  • 얼굴만 담은 헤드샷. 머리만, 무표정, 어깨나 목, 배경은 최소한으로. 모델이 정체성을 기대는 이미지이므로 얼굴이 프레임을 지배해야 합니다. 복잡한 전신 사진 안에서 얼굴이 작은 영역에 불과하면 모델은 얼굴에 낮은 가중치를 주고 주변의 잡다한 요소가 스며듭니다.
  • 전신 사진. 스타일링, 의상, 비율을 담당합니다.

그런 다음 프롬프트에서 역할을 명시적으로 나누고, 얼굴을 먼저 두세요.

캐릭터 레퍼런스 분리

@Image 1의 여성을 Subject 1로 정의한다. Subject 1의 얼굴 특징은 @Image 1(헤드샷)을 참조한다. 그녀의 의상과 스타일링은 @Image 2(전신 사진)를 참조한다.

이것은 얼굴에 해당하는 이야기입니다. 제품과 사물에는 여러 각도가 정말 유용하니 충분히 제공하세요.

혼합 레퍼런스의 실수: 얼굴, 포즈, 의상, 디테일 크롭을 한 장에 몰아넣은 합성 이미지를 모델에게 건네지 마세요. 얼굴이 전체 픽셀의 작은 부분만 차지하게 되고, 모델의 주의도 그만큼만 받게 되어 정체성이 흔들립니다.

그래도 캐릭터가 흔들린다면, 알아 둘 만한 결과가 하나 있습니다. 흔들리는 얼굴은 실존 공인을 닮는 쪽으로 흘러갈 수 있고, 그러면 유명인을 요청한 적이 없어도 심사 단계에서 생성이 차단될 수 있습니다. 즉 정체성 흔들림은 품질 문제만이 아닙니다. 멀쩡해 보이는 프롬프트가 거부되어 돌아오는, 잘 알려지지 않은 이유 중 하나입니다. 거부 문제는 Seedance 2.0 프롬프트가 플래그될 때 가이드에서 자세히 다룹니다.

같은 이름 유지하기 모든 프롬프트에서 캐릭터에게 같은 이름을 쓰고, "@Image [X]의 외모를 정확히 유지한다"라고 지정하세요.

캐릭터 일관성

@Image 1의 탐정을 등장시킨다(이 레퍼런스의 얼굴 특징, 헤어스타일, 의상을 정확히 유지한다). 이 장면에서 탐정은 @Image 2의 창고로 들어간다. 탐정의 모든 신체적 특징은 @Image 1과 정확히 일치해야 한다. 같은 얼굴, 같은 코트, 같은 체형.

장면 간 스타일 일관성

여러 샷에서 시각적 처리를 동일하게 유지해야 하는 프로젝트라면 다음을 쓰세요.

기법 1: 스타일 레퍼런스 템플릿 원하는 시각 스타일을 완벽하게 담은 이미지 하나를 고르세요.

  • 컬러 그레이딩
  • 조명 방식
  • 구도 스타일
  • 질감과 디테일 수준

그리고 모든 생성 프롬프트에 이 같은 스타일 레퍼런스를 넣으세요.

스타일 레퍼런스 템플릿

전체적으로 @Image 1의 시각 스타일을 유지한다. 음울한 블루 컬러 그레이딩, 높은 대비의 조명, 필름 그레인 질감, 얕은 심도.

기법 2: 이전 결과물을 레퍼런스로 쓰기 앞서 성공한 생성물을 이후 샷의 레퍼런스로 쓰세요.

이전 결과물을 레퍼런스로

@Video 1(내 이전 생성물)의 시각 스타일을 정확히 유지한 다음 장면을 만든다. 컬러 그레이딩, 조명 방식, 전체 미감이 정확히 일치해야 한다.

연속 샷의 시간적 연결성

순서대로 이어지는 샷을 만들 때는 다음을 쓰세요.

기법 1: 겹침 서술 새 샷이 앞 샷과 어떻게 연결되는지 설명하세요.

겹침 서술

이 샷은 @Video 1이 끝난 지점에서 정확히 이어진다. @Video 1의 마지막에 문을 향해 서 있던 인물이 이제 카메라 쪽으로 돌아서서 말하기 시작한다. 위치와 조명은 @Video 1의 마지막 프레임과 일치해야 한다.

기법 2: 전환 지점 지정 연결 지점을 분명히 밝히세요.

전환 지점 지정

@Video 1이 끝난 것과 같은 카메라 앵글과 위치에서 이 생성을 시작한다. 인물은 같은 위치에서 동작 중이어야 하고, 이 샷은 그 움직임을 부드럽게 이어 간다.

피해야 할 흔한 함정

함정 1: 모호한 레퍼런스 사용

문제: 어떤 측면을 참조할지 밝히지 않은 "@Image 1을 레퍼런스로"

해결: 레퍼런스가 무엇을 제공하는지 항상 명시하세요. "@Image 1은 캐릭터의 얼굴 특징과 표정에 사용하고, 배경이나 조명에는 사용하지 않는다"

함정 2: 서로 모순되는 지시

문제: "느리고 사색적인 카메라 움직임과 차분한 앰비언트 음악을 곁들인 빠른 액션 장면"

해결: 모든 요소를 정렬하세요. 액션의 속도, 카메라의 에너지, 음악의 템포, 편집의 리듬이 하나의 목표를 향하게 하세요

함정 3: 프롬프트를 과도하게 복잡하게 만들기

문제: 거의 구분되지 않는 레퍼런스를 열두 개 올리고, 상충하는 디테일로 가득한 500단어짜리 프롬프트를 쓰는 것. ByteDance의 안내는 이 점에 대해 단호합니다. 대본 전체를 모델에게 넘기지 말고, 허용치를 전부 쓰지 마세요

해결: 더 적고 더 영향력 있는 레퍼런스를 쓰고, CRAFTS 프레임워크를 따르는 명확하고 구조화된 프롬프트를 쓰세요

함정 4: 길이 제한 무시하기

문제: 30초 분량의 상세한 액션을 15초 생성에 밀어 넣으려는 시도

해결: 복잡한 시퀀스를 여러 번의 생성으로 나누거나, 시간 제약에 맞게 동작을 단순화하세요

함정 5: 카메라 워크를 덜 지정하기

문제: 방향 없이 "카메라가 주위를 움직인다"

해결: 정확한 촬영 용어를 쓰세요. "카메라가 아이 레벨을 유지하며 와이드 샷에서 미디엄 클로즈업으로 달리 인한다"

함정 6: 오디오 통합을 소홀히 하기

문제: 오디오를 뒷전으로 두거나 "음악 추가"라고만 언급하기

해결: 오디오가 무엇을 위한 것인지 밝히고, 소리를 그것이 속한 샷 안에 넣으세요. "(@Audio 1의 몰아치는 리듬이 전체에 흐른다). 모든 컷이 비트에 맞아떨어진다."

함정 7: 레퍼런스 품질이 들쭉날쭉함

문제: 고해상도 전문 사진과 저화질 압축 이미지를 섞어 쓰기

해결: 모든 레퍼런스의 품질을 고르게 유지하세요. 품질이 나쁜 레퍼런스 하나가 생성 전체를 망치게 두지 마세요

함정 8: 모델이 알아서 추론할 것이라 가정하기

문제: "멋지게 만들어 줘" 또는 "무슨 말인지 알잖아"

해결: 중요한 디테일은 전부 명시하세요. 모델은 지시를 실행할 뿐, 모호한 의도를 해석하지 않습니다

빠른 문제 해결 가이드

증상: 생성할 때마다 캐릭터의 외모가 달라진다 해결: 모든 프롬프트에서 동일한 캐릭터 레퍼런스 이미지를 쓰고, "@Image X의 외모를 정확히 유지한다"라고 명시하세요

증상: 카메라 움직임이 레퍼런스와 맞지 않는다 해결: 텍스트에 카메라 움직임을 더 구체적으로 설명하고, 복잡한 움직임은 단계로 나누세요

증상: 스타일이 레퍼런스와 맞지 않는다 해결: 레퍼런스와 함께 구체적인 스타일 요소를 텍스트로 설명하세요. "@Image 1의 컬러 그레이딩에 맞춘다. 채도를 낮춘 블루, 높은 대비, 뭉개진 블랙"

증상: 호흡이 어색하다 해결: 타임코드를 더하고 싶은 충동을 참으세요. 대개 상황이 나빠집니다. 한 클립에 요구하는 샷 수를 줄이고, 중요한 박자에는 자기만의 샷을 주세요.

증상: 오디오가 분위기와 맞지 않는다 해결: 파일만 가리키지 말고 오디오의 역할을 분명히 설명하세요. "@Audio 1"이 아니라 "(@Audio 1의 긴장감, 서스펜스를 쌓아 올리는)"입니다.

증상: 목소리가 레퍼런스 오디오처럼 들리지 않는다 해결: 오디오 레퍼런스만으로는 음색 전달이 약합니다. 참조와 함께 목소리를 말로도 설명하세요. "@Audio 1의 낮고 따뜻하며 약간 거친 중년 남성 목소리로 다음을 말한다..." 대사의 톤을 레퍼런스 녹음과 비슷하게 유지하는 것도 도움이 됩니다.

증상: 같은 캐릭터의 똑같은 복제 둘이 한 프레임에 나온다 해결: "쌍둥이" 버그입니다. 다각도 캐릭터 시트를 그만 쓰고, 한 사람만 담은 레퍼런스 사진을 쓰고, 각 캐릭터에 이름을 붙여 이미지와 짝지으세요("Ada(@Image 1)가 Ben(@Image 2)에게 서류를 건넨다"). 그리고 마무리 제약을 더하세요. "영상 전체에서 중복 캐릭터나 쌍둥이 효과를 생성하지 않는다. 각 캐릭터는 화면에 하나만 유지한다."

증상: 요청한 적 없는 자막이나 워터마크가 나온다 해결: 제약 문장을 더하고("자막은 넣지 않는다", "워터마크를 생성하지 않는다"), 업로드 전에 레퍼런스 소재에서 텍스트를 지우고, 가능하면 가로로 생성하세요. 엉뚱한 자막은 세로보다 가로에서 확연히 덜 나타납니다.

증상: 애니메이션 스타일이 실사로 되돌아갔다 해결: 실사 레퍼런스 이미지는 별도로 말하지 않는 한 결과를 실사 쪽으로 끌고 갑니다. 프롬프트에서 스타일을 명시하거나("2D 일본 애니메이션 스타일"), 생성 전에 레퍼런스 이미지를 목표 스타일로 변환하세요.

증상: 설명한 효과가 뭉개져 나온다. 예를 들어 카운트다운의 숫자가 뒤죽박죽이다 해결: 효과를 설명하지 말고 보여 주세요. 그 효과가 담긴 레퍼런스 영상을 넣고 지목하세요. "숫자가 나타나는 방식은 @Video 1을 따른다." 움직임의 논리는 모델이 텍스트보다 푸티지에서 훨씬 잘 읽는 것 중 하나입니다.

증상: 영상이 딸깍 소리나 갑자기 끊기는 소음으로 끝난다 해결: 내레이션이 있는 클립에서 알려진 아티팩트입니다. 다시 생성하거나, 편집 툴에서 오디오 트랙 끝에 짧은 볼륨 페이드를 적용해 고치세요. 20초면 되는 수정이고, 생성 한 번을 태울 가치가 없습니다.

증상: 화면이 튀거나 늘어나고, 레퍼런스 사진이 왜곡되어 보인다 해결: 대개 화면비 불일치입니다. 레퍼런스 이미지의 비율이 선택한 출력 비율과 맞지 않으면 모델이 억지로 맞춰야 합니다. 업로드 전에 목표 비율로 이미지를 크롭하거나, 출력을 적응형 비율로 설정해 레퍼런스를 따르게 하세요. 레퍼런스 이미지는 화면비 0.4에서 2.5 사이, 각 변 300에서 6000px 안에 있어야 합니다.

맺음말

Seedance 2.0은 포괄적인 멀티모달 접근을 통해 AI 영상 생성에서 근본적인 진전을 보여 줍니다. 이미지, 영상, 오디오, 텍스트를 입력으로 받아들여, 텍스트 전용 프롬프트를 넘어 보여 주면서 연출하는 방식으로 창작 과정에 전례 없는 제어를 제공합니다.

AI 영상 지형에서 Seedance 2.0의 위치

멀티모달 역량이 Seedance 2.0을 경쟁 플랫폼과 구분 짓습니다. Kling, Veo, Sora 모두 인상적인 텍스트 투 비디오 역량을 갖췄지만, Seedance는 영상과 오디오를 직접 참조할 수 있어 텍스트 설명만으로는 어렵거나 불가능한 카메라 워크, 모션 패턴, 리듬 동기화의 정밀한 재현이 가능합니다. 그래서 시각 스타일, 캐릭터 일관성, 영화적 실행에 엄밀한 제어가 필요한 전문가에게 Seedance는 우선적인 선택이 됩니다.

이 플랫폼은 기능 개선과 지원 확대를 계속하고 있습니다. 멀티모달 레퍼런스 시스템과 CRAFTS 프롬프트 프레임워크를 익혀 두면, 플랫폼이 발전할수록 점점 더 정교한 영상 제작을 감당할 토대가 됩니다.

핵심 정리

멀티모달 제어: 이미지, 영상, 오디오, 텍스트 입력의 조합 덕분에 원하는 것을 말로 전부 설명하려 애쓰는 대신 AI에게 그대로 보여 줄 수 있습니다. 이 근본적인 전환이, 정확한 카메라 움직임, 특정 안무, 비트에 맞춘 편집처럼 예전에는 까다로웠던 요구를 단순하게 만듭니다.

전략적 비교 우위: Kling, Veo, Sora와 비교할 때 Seedance 2.0은 오디오 통합과 영상 레퍼런스의 깊이에서 고유한 역량을 제공합니다. 오디오 파일을 직접 올려 참조하는 시스템으로 분위기와 비트 동기화를 정밀하게 제어할 수 있습니다. 영상 레퍼런스 기능은 스타일 전이를 넘어 모션과 카메라 워크의 전면 복제로 나아갑니다.

CRAFTS 전문 프레임워크: 여섯 단계의 CRAFTS 방법론(Context, Reference, Action, Framing, Timeline, Style and constraints)은 완결된 프롬프트가 지정해야 할 모든 것을 다룹니다. 사람들이 가장 자주 건너뛰는 두 부분이 곧 생성의 성패를 가릅니다. 참조하기 전에 피사체를 정의하는 것, 그리고 아티팩트를 차단하는 제약으로 프롬프트를 닫는 것입니다.

샷의 순서를 정하되 시간을 재지 마세요: 초 단위 타임코드를 쓰고 싶은 본능이 Seedance의 결과를 나쁘게 만드는 가장 흔한 원인입니다. 샷의 순서를 정하고 호흡은 모델이 찾게 두세요.

절제가 물량을 이깁니다: 잘 고른 소재 네다섯 개가 열두 개를 이깁니다. 레퍼런스를 하나 더할 때마다 모델이 어떤 특징이 중요한지 판단하기 어려워지고, 특히 캐릭터 턴어라운드는 정체성 흔들림을 적극적으로 유발합니다.

Morphic에서 사용 가능: 전문 크리에이터는 Morphic을 통해 Seedance 2.0 가족 전체를 쓸 수 있습니다. 값싼 반복 작업용 Fast와 Mini, 4K 최종본용 풀 Seedance 2.0이 모두 포함됩니다.

만들 준비가 되었나요? Morphic에서 Seedance 2.0 사용하기 →

자주 묻는 질문

여러 Seedance 2.0 영상에 걸쳐 캐릭터 일관성을 유지하려면 어떻게 하나요?

그 캐릭터가 등장하는 모든 생성에서 같은 캐릭터 레퍼런스 이미지를 쓰세요. 프롬프트에는 "@Image X의 외모를 정확히 유지한다"라고 명시하고, 변형(다른 옷, 다른 표정)이 있다면 설명하되 얼굴 특징, 체형, 그 밖의 식별 특성은 동일하게 유지된다는 점을 강조하세요. 가장 좋은 결과를 위해 선명하고 조명이 좋은 정면 사진을 대표 캐릭터 레퍼런스로 쓰세요.

레퍼런스 영상에서 본 특정 카메라 움직임을 어떻게 복제하나요?

원하는 카메라 워크가 담긴 영상을 올리고 구체적으로 참조하세요. "@Video 1은 카메라 움직임에만 사용한다." 텍스트 프롬프트에서는 촬영 용어로 움직임을 설명하세요(달리 인, 트래킹 샷, 크레인 업). 복잡한 움직임은 타임코드가 아니라 샷으로 나누세요. "샷 1: 와이드에서 미디엄으로 달리 인. 샷 2: 거리를 유지하며 오른쪽으로 팬." 샷 하나에는 카메라 무브 하나만 두세요. 푸시, 오빗, 팬을 한 샷에 쌓는 것이 화면을 불안정하게 만드는 가장 빠른 길입니다.

Seedance 2.0 영상을 특정 음악 비트에 어떻게 맞추나요?

음악 트랙을 올린 다음, 초가 아니라 비트로 싱크를 설명하세요. 모델의 정밀 타임코드 처리는 불안정합니다. 예를 들면 이렇게 씁니다. "(@Audio 1의 경쾌한 음악). 모든 컷이 비트에 맞아떨어진다." 그리고 각 컷을 하나의 샷으로 씁니다. 비트를 기준으로 한 지시가 "6초 지점에서"보다 훨씬 안정적으로 먹힙니다.

여러 Seedance 2.0 클립 사이를 부드럽게 전환하려면 어떻게 하나요?

영상 확장 기능이나 융합 기법을 쓰세요. 확장: 기존 영상을 올리고 "@Video 1 이후의 내용을 생성한다"라고 말한 뒤 연결 동작을 설명하고, 길이는 프롬프트가 아니라 생성 설정에서 정하세요. 융합: 한 클립의 끝과 다른 클립의 시작을 참조하는 다리 구간을 만들고, 둘을 잇는 전환 동작을 명시적으로 설명하세요.

Seedance 2.0 영상에서 특정 동작의 길이를 어떻게 제어하나요?

원하는 만큼 직접적으로는 어렵고, 이것이 이 모델에서 가장 약한 제어 수단입니다. 정밀한 타임코드("0-3초: [동작]")는 불안정하고, 구간에 정확한 길이를 강요하면 결과가 촘촘해지기는커녕 나빠질 수 있습니다. 대신 샷의 순서를 정하고("샷 1: ... 샷 2: ...") 호흡은 모델이 찾게 두세요. 동작이 급해 보인다면 믿을 만한 해법은 클립의 샷 수를 줄이거나, 그 동작에 자기만의 샷을 주거나, 전체 생성 길이를 늘리는 것이지, 더 촘촘한 타임코드를 쓰는 것이 아닙니다.

레퍼런스 파일은 실제로 몇 개나 올려야 하나요?

허용된 것보다 적게 올리세요. ByteDance는 소재 4-5개를 권장합니다. 캐릭터 이미지 1-2장, 장면 이미지 1장, 카메라 움직임 영상 1개, 오디오 클립 1개입니다. 그 이상이면 모델이 어떤 특징이 우선인지 판단하기 어려워지고, 스타일 충돌과 흐릿한 피사체 식별, 브리프에서 벗어난 결과가 나옵니다. 요령은 이렇습니다. 정말로 설명하기 어려운 것(특정한 얼굴, 정확한 카메라 무브, 특정 안무)만 올리고 나머지는 텍스트 프롬프트에 담으세요. 레퍼런스 인물이 넷을 넘어가면 안정성이 급격히 떨어진다는 점도 기억하세요.

레퍼런스 영상에서 본 특수 효과를 어떻게 재현하나요?

원하는 효과가 담긴 영상을 올리고 지정하세요. "@Video 1은 파티클 효과 기법에만 사용한다." 텍스트 프롬프트에서는 효과를 자세히 설명하세요. 언제 발생하는지, 어떻게 움직이는지, 시각적 특징은 무엇인지. 효과가 분리되어 분명히 보이는 레퍼런스 클립을 쓰면 결과가 가장 좋습니다. "@Video 1의, 바닥에서 솟아올라 머리 높이에서 흩어지는 빛나는 입자의 소용돌이를 참조한다."

Seedance 2.0 캐릭터가 특정한 목소리로 말하게 하려면 어떻게 하나요?

원하는 목소리가 담긴 오디오나 영상 레퍼런스를 올리고 지정하세요. "@Audio 1은 목소리 음색과 전달 스타일에 사용한다." 프롬프트에서는 발성 특성을 설명하세요. "캐릭터는 @Audio 1의 낮고 권위 있는 톤으로 다음 대사를 말한다: [대사 내용]."

관련된 영상을 여러 편 만들 때 결과가 들쭉날쭉하면 어떻게 고치나요?

시퀀스의 모든 생성에서 레퍼런스 소재를 일관되게 유지하세요. 같은 스타일 레퍼런스 이미지, 같은 캐릭터 레퍼런스를 쓰고, 프롬프트도 꼭 필요한 부분만 바꾸세요. 앞서 성공한 결과물에 대한 참조를 넣으면 연속성이 유지됩니다. "@Video 1(이전 생성물)의 시각 스타일을 유지한다."

15초보다 긴 Seedance 2.0 영상은 어떻게 만드나요?

영상 확장을 쓰세요. 첫 구간을 생성한 다음 그것을 올리고 "@Video 1 이후의 내용을 생성한다"라고 말하며 다음에 벌어질 일을 설명하세요. 확장을 연쇄할 수는 있지만 체인은 짧게 유지하세요. 회차마다 화질이 떨어지고 손상이 누적되며, 얼굴에 얼룩덜룩한 색으로 가장 먼저 나타납니다. 이음매에서 눈에 띄는 튐도 예상하세요. 편집 툴에서 앞 클립 끝을 약 6프레임, 뒤 클립 시작을 1프레임 잘라 내면 됩니다. 길거나 빠른 호흡의 작업이라면 확장을 길게 연결하는 것보다 클립을 따로 만들어 편집으로 이어 붙이는 편이 대개 낫습니다.

전문 영상 작업에서 Seedance 2.0과 Kling의 가장 큰 차이는 무엇인가요?

Seedance 2.0의 주된 차별점은 오디오 파일 직접 업로드를 포함한 폭넓은 멀티모달 입력과, 영상 레퍼런스·편집 시스템의 깊이입니다. 두 모델 모두 멀티모달 입력을 받으므로, 차이는 무엇을 붙일 수 있느냐보다 올린 클립으로 모델이 무엇을 하느냐에 있습니다. Seedance는 클립 안을 편집하고, 앞뒤 어느 방향으로든 확장하고, 클립을 이어 붙입니다. 스타일만 흉내 내는 것이 아닙니다. 이미 푸티지가 존재하고 승인까지 난 프로젝트에서 그 차이가 가장 크게 다가옵니다.

Seedance 2.0의 오디오 통합은 다른 AI 영상 도구와 어떻게 다른가요?

Seedance 2.0은 오디오 파일을 직접 받고, 거기서 세 가지를 뽑아냅니다. 음색, 멜로디, 대사 내용. 즉 실제 음악 트랙이나 원하는 목소리의 녹음을 그대로 건넬 수 있고, 둘 중 어느 것도 말로 설명할 필요가 없습니다. Veo와 Sora는 레퍼런스 오디오를 받는 대신 텍스트 설명으로 오디오를 생성합니다. 솔직한 단서 하나. 오디오 레퍼런스만으로는 목소리 재현이 부족한 편입니다. 음색을 텍스트로도 설명하세요. 예를 들면 "@Audio 1의 낮고 따뜻하며 약간 거친 중년 남성 목소리를 사용한다"처럼요.

Seedance 2.0은 Kling이나 Veo보다 긴 영상을 만들 수 있나요?

Seedance 2.0과 Kling 3.0은 모두 한 번에 최대 15초를 생성합니다. Sora는 더 길어서 최대 60초입니다. 다만 실무에서 이 상한은 들리는 것만큼 중요하지 않습니다. 대부분의 상업·소셜 작업은 하나의 롱테이크가 아니라 짧고 품질 좋은 클립 여러 개를 이어 붙여 만들기 때문입니다. Seedance가 앞서는 지점은 클립이 존재한 다음입니다. 앞뒤로 확장하고, 안을 편집하고, 클립을 이어 붙일 수 있습니다. 단일 생성이 길어지는 것과는 다른 종류의 길이입니다.

특정 스타일 복제에서 Seedance 2.0이 Runway보다 정확한가요?

Seedance 2.0의 멀티모달 접근은 스타일 복제에 더 직접적인 제어를 줍니다. 여러 레퍼런스 이미지, 스타일이 움직이는 모습을 담은 영상 클립, 분위기를 잡아 주는 오디오를 함께 올릴 수 있기 때문입니다. 스타일을 텍스트로 설명하는 대신 여러 각도의 예시를 보여 주는 셈입니다. 그래서 복잡한 스타일을 텍스트만으로 다룰 때보다 대체로 더 충실하게 재현합니다.

Seedance 2.0의 캐릭터 일관성은 다른 AI 영상 모델과 비교해 어떤가요?

Seedance 2.0의 이미지 레퍼런스 시스템은 프롬프트 전반에 일관된 캐릭터 이미지를 제대로 쓰면 강한 캐릭터 일관성을 제공합니다. Kling의 캐릭터 일관성 기능에 견줄 만하며, Veo나 Sora의 텍스트 기반 캐릭터 서술보다 제어하기 쉽습니다. 핵심은 고품질 캐릭터 레퍼런스 이미지를 쓰고, 생성마다 "@Image X의 외모를 정확히 유지한다"라고 명시하는 것입니다.

상업 제작에는 Seedance 2.0과 Veo 중 어느 것이 더 나은가요?

상업 작업에서 결정적인 요소는 대개 순수한 생성 품질이 아니라 제어력이고, 바로 거기서 Seedance 2.0의 레퍼런스 시스템이 값을 합니다. 정확한 제품 사진, 정확한 음악 트랙, 정확한 카메라 무브가 담긴 클립을 올릴 수 있습니다. 클라이언트가 이 셋을 이미 승인한 상황이라면 그 차이가 큽니다. Seedance는 기존 푸티지를 편집하고 확장할 수도 있어서, 승인된 소재를 다시 만들지 않고 재사용할 수 있습니다. Veo는 프롬프트 충실도와 장편 확장에 강해서, 브리프가 느슨하고 길이가 브랜드 정합성보다 중요한 경우에는 여전히 합리적인 선택입니다.

Seedance 2.0은 Sora가 하는 모든 것을 할 수 있나요?

둘은 서로 다른 일을 위해 만들어졌습니다. Sora는 최대 60초의 더 긴 단일 테이크를 생성하고, 텍스트만 으로 물리와 복잡한 장면을 추론하는 데 강합니다. Seedance 2.0은 한 번에 15초까지지만 Sora에 없는 제어를 줍니다. 오디오 직접 업로드, 모션과 카메라 복제를 위한 영상 레퍼런스, 여러 시각 레퍼런스의 동시 사용, 그리고 이미 가진 푸티지를 편집하고 확장하는 능력입니다. 프롬프트가 한 문단의 서술이라면 Sora가 매력적입니다. 소재가 있고 원하는 결과가 분명하다면 Seedance의 레퍼런스 시스템이 더 제어하기 좋은 도구입니다.

Seedance 2.0의 영상 레퍼런스 기능은 Kling의 모션 제어와 어떻게 다른가요?

두 플랫폼 모두 모션 레퍼런스 기능을 제공하지만, Seedance 2.0의 영상 레퍼런스 시스템이 더 깊이 들어갑니다. Kling은 모션 브러시와 기본적인 모션 전이를 제공하고, Seedance는 완전한 영상 클립을 올려 모션 경로뿐 아니라 카메라 워크, 편집 리듬, 복잡한 안무까지 프레임 단위로 복제하게 해줍니다. 격투 시퀀스나 댄스 루틴 전체를 Seedance에 보여 주면, 그것을 설명하거나 모션 경로를 그리는 대신 정확히 복제하게 할 수 있습니다.

Seedance 2.0, Fast, Mini의 차이는 무엇인가요?

셋은 같은 기능 세트를 공유하고 품질과 비용에서 갈립니다. Seedance 2.0은 품질이 가장 높고, 셋 중 4K를 출력하는 유일한 모델입니다. Seedance 2.0 Fast는 품질을 조금 내주고 속도와 비용을 얻습니다. Seedance 2.0 Mini는 가장 저렴하고 대량 반복 작업에 가장 잘 맞습니다. Fast와 Mini는 모두 720p까지 입니다. 실무적인 워크플로는 프롬프트와 레퍼런스가 잘 먹힐 때까지 Mini나 Fast로 반복한 다음, 최종본만 풀 Seedance 2.0으로 돌리는 것입니다.

Seedance 2.0은 어떤 파일 형식을 업로드로 받나요?

이미지는 JPG 또는 PNG, 영상은 MP4 또는 MOV, 오디오는 MP3입니다. 출력은 MP4이며 4K는 10-bit H.265로 인코딩되어, 파일 자체는 멀쩡해도 일부 브라우저와 플레이어에서는 바로 미리보기가 되지 않습니다. 가진 것 중 가장 품질이 좋은 소스를 쓰세요. 레퍼런스 클립의 압축 아티팩트는 모델이 그 안의 모션을 읽는 정확도를 눈에 띄게 떨어뜨립니다.

한 번의 Seedance 2.0 생성에서 입력 제한은 어떻게 되나요?

이미지 최대 9장, 영상 클립 3개, 오디오 파일 3개입니다. 영상 클립은 각 2-15초에 합산 15초여야 하고, 오디오 파일도 같습니다. 유형을 합친 상한은 없어서 허용되는 최대 요청은 파일 15개지만, 거기 근처에도 가지 않는 편이 좋습니다. 소재 4-5개가 권장 작업 범위입니다. 작동하지 않는 조합이 하나 있습니다. 시각 자료 없이 텍스트와 오디오만, 그리고 오디오 단독으로는 생성되지 않습니다.

Seedance 2.0이 한 번에 생성할 수 있는 가장 긴 영상은 얼마인가요?

Seedance 2.0은 한 번의 생성으로 4초에서 15초 사이의 영상을 만듭니다. 길이는 1초 단위로 선택할 수 있습니다. 더 긴 콘텐츠에는 영상 확장 기능으로 여러 생성을 이어 붙이거나, 별도의 구간을 만들어 후반 작업에서 편집으로 합치세요.

Seedance 2.0을 상업 프로젝트와 클라이언트 작업에 쓸 수 있나요?

네, Morphic을 통한 Seedance 2.0은 상업 제작에 사용할 수 있습니다. 구체적인 라이선스와 사용 권리는 Morphic의 서비스 약관을 따릅니다. 상업적 이용, 클라이언트 작업, 표기 요건에 대한 세부 사항은 해당 약관을 확인하세요.

Seedance 2.0은 영상 전체 길이에 걸쳐 해상도 품질을 유지하나요?

한 번의 생성 안에서는 그렇습니다. 클립 전체에서 품질이 유지됩니다. 유지되지 않는 지점은 확장을 연쇄할 때입니다. 생성된 영상을 다시 넣어 확장할 때마다 화질이 조금씩 떨어지고 그것이 누적됩니다. 얼굴에 얼룩덜룩한 색 반점으로 가장 먼저 나타납니다. 확장 체인은 짧게 유지하세요.

Seedance 2.0으로 다양한 화면비의 영상을 만들 수 있나요?

네. Seedance 2.0은 21:9, 16:9, 4:3, 1:1, 3:4, 9:16을 지원하며 생성 설정에서 지정합니다. 2.35:1 옵션은 없으니 스코프 룩을 원한다면 21:9를 고르세요. 실무적인 참고 하나. 엉뚱한 자막은 세로보다 가로에서 눈에 띄게 덜 나타나므로, 최종물이 세로용이라면 가로로 생성한 뒤 잘라내는 편이 나을 수 있습니다.

Seedance 2.0은 어떻게 사용하나요?

Seedance 2.0은 Morphic에서 사용할 수 있습니다. Morphic에 접속해 계정을 만들거나 로그인한 뒤, 영상 생성 인터페이스에서 Seedance 2.0을 이용하세요. 멀티모달 입력 시스템과 @ 레퍼런스 기능이 Morphic의 워크플로에 통합되어 있습니다.

Seedance 2.0이 생성한 영상을 나중에 편집하거나 수정할 수 있나요?

네, 생성된 영상은 여러 방식으로 쓸 수 있습니다. 새 생성의 레퍼런스로 쓰거나(특정 요소를 바꾸기 위해), 영상 확장의 입력으로 쓰거나(뒤에 내용을 덧붙이기 위해), 영상 융합 워크플로에 넣거나(다른 클립과 잇기 위해), 내보내서 일반 편집 소프트웨어에서 작업할 수 있습니다. 생성된 영상은 여러분의 것이며, 프로젝트에 맞는 어떤 워크플로로든 편집하고 결합하고 다듬을 수 있습니다.