멀티모달

Flux 3

Black Forest Labs 제공

영상과 소리를 함께 만드는 Black Forest Labs의 월드 모델, 동작에 딱 맞는 사운드까지 담깁니다.

Flux 3

주요 기능

기술 사양

5~20초

한 번의 생성에서 초 단위로 지정하거나, 프롬프트에 맞춰 자동으로 정해집니다

720p / 1080p

기본은 HD, 업스케일링으로 풀HD까지

T2V·I2V·V2V

텍스트, 이미지·키프레임, 기존 클립 이어가기를 지원

네이티브

모든 클립에 동기화된 오디오가 기본으로 생성됩니다

활용 사례

한 번에 소리까지 담기는 영상

프롬프트 하나로 클립과 오디오가 함께 나와, 효과음이나 대사를 나중에 따로 입힐 필요 없이 이미 동작과 맞춰져 있습니다.

멀티샷 시퀀스

한 번의 생성으로 여러 앵글을 구성하거나 이어가기로 클립을 늘려, 컷이 바뀌어도 한 캐릭터를 그대로 유지합니다.

제품·브랜드 필름

카메라가 움직여도 소재와 무게감, 반사가 사실적으로 유지되어, 제품이 합성이 아니라 실제로 촬영한 것처럼 보입니다.

다국어 영상 현지화

다국어 대사와 정확한 화면 텍스트 덕분에, K-콘텐츠를 해외에 내보낼 때도 별도의 자막·더빙 작업 없이 한 장면을 여러 언어로 그대로 만듭니다.

안무처럼 짜인 전환

샷이 반드시 지나가야 할 포즈와 구도를 미리 지정하면, 모델이 그 사이의 움직임을 하나의 연속된 테이크로 이어 붙입니다.

실제 물리를 담은 설명 영상

중력과 충돌, 움직임이 실제 법칙을 따르므로, 과학이나 원리 설명 영상도 깔끔하면서 정확하게 유지됩니다.

프롬프트 예시

물리 법칙에 충실한 클립

물리 법칙에 충실한 클립

세라믹 머그컵이 대리석 조리대에서 미끄러져 바닥에 떨어지며 산산조각 난다, 파편이 흩어지고 날카로운 충돌음이 그 순간과 정확히 맞물린다

Edit prompt
멀티샷 시퀀스

멀티샷 시퀀스

빨간 재킷을 입은 같은 배달원, 한 컷은 시장 골목을 헤치고 지나가고 다음 컷은 해 질 녘 불 켜진 문 앞에 도착한다

Edit prompt
현지화 타이틀 카드

현지화 타이틀 카드

커피 브랜드 히어로 샷, 갓 내린 커피에서 김이 피어오르고, 화면 타이틀에 선명한 볼드 서체로 '갓 볶은 원두'라는 문구가 나타난다

Edit prompt
캠코더에서 시네마틱으로

캠코더에서 시네마틱으로

생일 파티를 찍은 핸드헬드 캠코더 영상, 이어서 같은 장면을 룸 톤이 깔린 따뜻한 시네마틱 와이드로

Edit prompt
클립 이어가기

클립 이어가기

창가에서 몸을 돌려 비에 젖은 서울 거리로 걸어 나가고, 카메라는 컷 없이 그대로 뒤따른다

Edit prompt
스튜디오 제품

스튜디오 제품

티타늄 받침대 위에서 회전하는 아방가르드 스니커즈, 강한 키 라이트, 정확한 금속 반사, 희미한 기계음

Edit prompt

간단한 가격

오늘 무료로 시작하고 언제든지 업그레이드하거나 취소할 수 있습니다.

Basic

$9/
청구 금액 $0

900 월간 크레딧

1 명 전용

모든 모델

워크플로

Standard

$24/
청구 금액 $0

3200 월간 크레딧

1 명 전용

모든 모델

워크플로

Pro

$45/
청구 금액 $0

6200 공유 월간 크레딧

1 사용자

+ 최대 4 명 추가 비용으로 추가 가능

모든 모델

워크플로

Pro Max

$170/
청구 금액 $0

24000 공유 월간 크레딧

1 사용자

+ 최대 9 명 추가 비용으로 추가 가능

모든 모델

워크플로

Enterprise

더 높은 제한

사용자 정의

가격 및 청구 조건

대용량 크레딧
맞춤형 시트 제한
모든 모델
워크플로
Pricing Gradient

Free

가볍게 사용해보기

$0

영구 무료

최대 20 크레딧
1명 전용
일부 모델
워크플로

자주 묻는 질문

Flux 3란 무엇인가요?
Flux 3는 Black Forest Labs의 멀티모달 파운데이션 모델로, 2026년 7월 23일에 공개되었습니다. 이미지와 영상, 오디오를 하나의 통합 아키텍처에서 함께 학습해, 단일 모델이 동기화된 오디오가 담긴 영상을 생성하면서도 현실 세계가 어떻게 보이고 움직이고 들리는지에 대한 일관된 이해를 유지합니다. 영상 생성 기능은 2026년 8월 4일부터 정식 제공되었습니다.
Flux 3는 이미지 모델인가요, 영상 모델인가요?
하나의 멀티모달 모델이며, 지금 출시된 부분은 영상입니다. Black Forest Labs는 전체 학습 연산의 95% 이상을 영상 예측에 투입했고, Flux 3 Video는 현재 정식 제공 중입니다. Flux 3 Image와 로보틱스용 Flux 3 Action, 오픈 웨이트 버전인 Flux 3 Dev는 발표만 되었고 순차적으로 공개될 예정입니다.
Flux 3 영상은 최대 몇 초까지 만들 수 있나요?
Flux 3는 한 번의 생성으로 5초에서 20초까지, 초 단위로 지정하거나 프롬프트에 맞게 자동으로 길이를 정합니다. 더 긴 작품이 필요하면 이어가기로 클립을 마지막 프레임부터 늘릴 수 있고, 한 번의 생성 안에서 여러 샷과 카메라 앵글을 컷으로 묶어 구성할 수도 있습니다.
Flux 3는 오디오도 함께 생성하나요?
네, 기본으로 켜져 있습니다. 모든 클립이 같은 과정에서 동기화된 오디오와 함께 만들어져, 효과음과 배경음, 대사가 화면 속 상황과 이미 맞춰져 있습니다. 소리는 물리적 사건을 그대로 따라가므로 충돌음이 타격 순간과 정확히 일치하며, 오디오를 끄고 무음 클립으로 만드는 것도 가능합니다.
Flux 3는 어떤 영상 생성 모드를 지원하나요?
세 가지입니다. 텍스트-투-비디오는 프롬프트만으로 작동하고, 이미지-투-비디오는 정지 이미지를 시작 프레임으로 쓰거나 최대 10장을 타임스탬프에 맞춰 키프레임으로 지정할 수 있습니다. 영상 이어가기는 기존 클립을 마지막 프레임에서부터 연장합니다. 영상 편집과 이미지·영상·오디오를 함께 참조하는 기능은 다음 단계로 발표된 상태입니다.
Flux 3의 해상도와 화면비는 어디까지 지원하나요?
Flux 3는 기본으로 HD 720p를 렌더링하고, 업스케일링을 거치면 풀HD 1080p까지 지원합니다. 화면비는 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, 9:16까지 총 7가지를 지원해, 시네마스코프 화면부터 세로형 숏폼까지 하나의 모델로 커버합니다.
Flux 3는 Flux 2와 무엇이 다른가요?
Flux 2 Pro는 이미지 모델입니다. Flux 3는 여기에 동기화된 오디오가 담긴 영상, 실제 물리 법칙을 따르는 움직임, 이미지·영상·오디오를 아우르는 하나의 공유 표현을 더한 멀티모달 파운데이션 모델입니다. Flux 2 라인이 정지 이미지에 집중했다면, Flux 3는 Black Forest Labs의 첫 영상 모델입니다.
Flux 3는 다른 영상 모델과 비교해 성능이 어떤가요?
Black Forest Labs가 출시 시점에 진행한 자체 사용자 평가에서, Flux 3는 텍스트-투-비디오 부문에서 비교한 모든 모델을 앞섰고 이미지-투-비디오에서는 Seedance 2.0과 동률, 나머지 모델은 모두 앞섰습니다. 이는 개발사 자체 결과이므로, 독립적인 벤치마크가 아니라 하나의 강한 참고 지표로 받아들이는 편이 정확합니다.
Flux 3는 한국어 대사와 텍스트도 지원하나요?
네. Flux 3는 다국어 대사와 화면 텍스트를 지원하며, 립싱크도 대사에 맞춰 자연스럽게 이어집니다. 한 장면을 여러 언어로 각각 촬영할 필요 없이, 한국어를 포함한 여러 언어로 같은 샷을 그대로 만들어 낼 수 있어 해외 배급을 염두에 둔 콘텐츠에 특히 유용합니다.
Morphic에서 Flux 3를 어떻게 사용하나요?
Flux 3는 지금 Morphic에서 바로 사용할 수 있습니다. Canvas를 열고 원하는 장면과 소리를 한 줄로 설명한 뒤 생성하세요. Morphic은 Flux 3를 Veo, Kling, Seedance 같은 모델과 나란히 제공하므로, 같은 프롬프트를 두 모델에 동시에 보내고 더 나은 결과만 남기는 방식으로 비교할 수 있습니다.