멀티모달

Flux 3

Black Forest Labs 제공

Black Forest Labs의 이미지, 비디오, 오디오 월드 모델.
동작에 딱 맞는 소리까지 함께 생성합니다.

Flux 3

주요 기능

기술 사양

이미지·비디오·오디오

하나의 모델에서 함께 학습; 행동 예측까지 확장

최대 20초

단일 생성 비디오 길이; 클립을 이어 붙여 더 긴 시퀀스로

네이티브

모든 비디오 클립과 함께 생성되는 동기화 오디오

Self-Flow

Black Forest Labs의 통합 멀티모달 아키텍처

활용 사례

한 번에 소리까지 담긴 비디오

프롬프트 하나로 클립과 그 오디오가 함께 돌아와, 효과음이나 대사가 나중에 덧입히는 대신 이미 동작과 싱크되어 있습니다.

멀티샷 시퀀스

클립을 이어 더 긴 장면을 만들고, 비주얼 레퍼런스로 컷마다 한 캐릭터를 유지해 짧은 클립부터 긴 작품까지 이어갑니다.

제품과 브랜드 필름

카메라가 움직여도 재질, 무게, 반사가 사실적으로 유지되어, 제품이 시뮬레이션이 아니라 촬영한 것처럼 읽힙니다.

현지화 비디오

다국어 대사와 정확한 화면 텍스트 덕분에 한 장면을 별도의 자막·더빙 작업 없이 여러 언어로 납품할 수 있습니다.

이미지 생성과 편집

여러 스타일과 화면비를 넘나들며 합성하고, 선명한 다국어 텍스트를 렌더링한 뒤, 전체를 다시 만들지 않고 한 영역만 그 자리에서 편집합니다.

실제 물리를 갖춘 설명 영상

중력, 충돌, 움직임이 실제 규칙을 따르므로 과학이나 원리 설명 영상이 깔끔하면서도 정확하게 유지됩니다.

프롬프트 예시

물리 충실 클립

물리 충실 클립

세라믹 머그가 대리석 카운터에서 미끄러져 바닥에 떨어져 산산조각, 파편이 흩어지고 날카로운 충돌음이 싱크로 들린다

Edit prompt
멀티샷 시퀀스

멀티샷 시퀀스

빨간 재킷의 같은 배달원: 한 샷은 시장을 헤치고 지나가고, 다음 샷은 해질녘 불 켜진 문 앞에 도착한다

Edit prompt
현지화 타이틀 카드

현지화 타이틀 카드

커피 브랜드 히어로 샷, 갓 내린 커피에서 김이 피어오르고, 화면 타이틀에 선명한 볼드 서체로 'Freshly Roasted'

Edit prompt
캠코더에서 시네마틱으로

캠코더에서 시네마틱으로

생일 파티를 찍은 핸드헬드 캠코더 영상, 이어서 같은 장면을 룸 톤이 깔린 따뜻한 시네마틱 와이드로

Edit prompt
인컨텍스트 편집

인컨텍스트 편집

레퍼런스 클립의 피사체를 가져와 밤에 비에 젖은 도쿄 거리를 걷게 하고, 나머지는 유지한다

Edit prompt
스튜디오 제품

스튜디오 제품

티타늄 받침대 위에서 회전하는 아방가르드 스니커즈, 강한 키 라이트, 정확한 금속 반사, 희미한 기계음

Edit prompt

간단한 가격

오늘 무료로 시작하고 언제든지 업그레이드하거나 취소할 수 있습니다.

Basic

$9/
청구 금액 $0

900 월간 크레딧

1 명 전용

모든 모델

워크플로

Standard

$24/
청구 금액 $0

3200 월간 크레딧

1 명 전용

모든 모델

워크플로

Pro

$45/
청구 금액 $0

6200 공유 월간 크레딧

1 사용자

+ 최대 4 명 추가 비용으로 추가 가능

모든 모델

워크플로

Pro Max

$170/
청구 금액 $0

24000 공유 월간 크레딧

1 사용자

+ 최대 9 명 추가 비용으로 추가 가능

모든 모델

워크플로

Enterprise

더 높은 제한

사용자 정의

가격 및 청구 조건

대용량 크레딧
맞춤형 시트 제한
모든 모델
워크플로
Pricing Gradient

Free

가볍게 사용해보기

$0

영구 무료

최대 20 크레딧
1명 전용
일부 모델
워크플로

자주 묻는 질문

Flux 3란 무엇인가요?
Flux 3는 Black Forest Labs의 멀티모달 파운데이션 모델로, 2026년 7월 23일에 공개되었습니다. 이미지, 비디오, 오디오를 하나의 통합 아키텍처에서 함께 학습하므로, 단일 모델이 네이티브 오디오가 담긴 비디오를 생성하고, 이미지를 합성·편집하며, 현실 세계가 어떻게 보이고 움직이고 들리는지에 대한 일관된 이해를 유지합니다.
Flux 3는 이미지 모델인가요, 비디오 모델인가요?
둘 다입니다. Flux 3는 분리된 도구가 아니라 하나의 멀티모달 모델입니다. 이미지를 생성·편집하고, 동기화된 네이티브 오디오와 함께 비디오를 생성하며, 이 모두가 같은 월드 모델에서 나옵니다. Black Forest Labs는 이 백본을 FLUX-mimic 파트너십을 통해 로보틱스용 행동 예측으로도 확장했으며, Audi의 실제 생산 작업에서 검증했습니다.
Flux 3 비디오는 얼마나 긴가요?
Flux 3는 한 번의 생성으로 최대 20초의 비디오를 만듭니다. 더 긴 작품에는 클립을 이어 멀티샷 시퀀스를 구성하고 비주얼 레퍼런스를 재사용해, 몇 분에 이르는 장면에서도 캐릭터를 일관되게 유지합니다. 각 클립은 이미 동작에 맞춰진 동기화 네이티브 오디오와 함께 돌아옵니다.
Flux 3는 오디오도 생성하나요?
네. 모든 Flux 3 비디오는 같은 생성 과정에서 네이티브 오디오와 함께 만들어지므로, 효과음, 배경음, 대사가 이미 화면 속 상황과 싱크되어 있습니다. 소리가 물리적 사건에 연동되어 충돌음이 타격과 맞물리며, Flux 3는 다국어 대사를 지원해 한 장면이 둘 이상의 언어로 말할 수 있습니다.
Flux 3는 이미지와 비디오를 편집할 수 있나요?
네. Flux 3는 이미지와 비디오 모두에 인컨텍스트 편집을 지원합니다. 이미지의 한 요소만 바꾸고 프레임의 나머지는 그대로 두거나, 소스 비디오의 피사체를 새 장면으로 가져올 수 있습니다. 이는 Morphic에서 이미 이미지 편집을 구동하는 Flux Kontext의 인스트럭션 편집 계보를 이어받습니다.
Flux 3는 Flux 2와 무엇이 다른가요?
Flux 2 Pro는 이미지 모델입니다. Flux 3는 네이티브 오디오 비디오, 실제 물리를 따르는 움직임, 그리고 이미지·비디오·오디오를 아우르는 하나의 공유 표현을 더한 멀티모달 파운데이션 모델입니다. 텍스트 렌더링과 프롬프트 처리도 크게 향상되어, Flux 2가 정지 이미지에 집중한 반면 Flux 3는 월드 모델입니다.
Flux 3는 오픈소스인가요?
Black Forest Labs는 이미지, 비디오, 오디오, 행동 예측을 아우르는 오픈 웨이트 멀티모달 백본인 Flux 3 Dev를 더 빠른 버전들과 함께 공개하겠다고 밝혔습니다. 오픈 웨이트 릴리스는 API와 프라이빗 웨이트 모델의 얼리 액세스 배포 이후로 예정되어 있어, 출시 시점에 바로 제공되기보다는 앞으로 나올 예정입니다.
Morphic에서 Flux 3를 어떻게 사용하나요?
Flux 패밀리는 이미 Flux 2 Pro와 Kontext 편집을 통해 Morphic의 이미지 작업을 구동하며, Nano Banana Pro, Seedream 5 같은 모델도 함께 제공됩니다. Morphic을 열고 원하는 바를 설명한 뒤 Canvas에서 생성하고, 모델을 나란히 비교해 샷에 가장 잘 맞는 결과를 남기세요.