Multimodal

Flux 3

oleh Black Forest Labs

World model AI dari Black Forest Labs untuk gambar, video, dan audio, dengan suara yang mengikuti aksinya.

Flux 3

Fitur utama

Spesifikasi teknis

5–20d

Dalam hitungan detik penuh sekali generate, atau otomatis menyesuaikan prompt

720p / 1080p

HD sebagai standar, Full HD lewat upscaling

T2V·I2V·V2V

Dari teks, dari gambar dan keyframe, atau lanjutan dari klip yang ada

Bawaan

Audio tersinkron dihasilkan bersama setiap klip, aktif secara default

Contoh penggunaan

Video beserta suara dalam sekali proses

Satu prompt langsung menghasilkan klip beserta audionya, jadi efek atau dialog sudah tersinkron sejak awal, bukan ditambahkan belakangan.

Urutan multi-shot

Susun beberapa sudut kamera dalam satu generate, atau perpanjang klip lewat continuation, sambil menjaga satu karakter tetap sama di setiap potongan.

Video produk dan merek

Material, bobot, dan pantulan cahaya tetap jujur saat kamera bergerak, sehingga produk terasa seperti hasil rekaman, bukan simulasi.

Video terlokalisasi

Dialog multibahasa dan teks di layar yang akurat memungkinkan satu adegan tayang dalam beberapa bahasa tanpa proses judul atau suara terpisah, termasuk untuk audiens berbahasa Indonesia.

Transisi yang terkoreografi

Kunci pose dan komposisi yang harus dilalui sebuah shot, lalu model menyambungkan gerakan di antaranya jadi satu take yang menyatu.

Video penjelas dengan fisika nyata

Gravitasi, tumbukan, dan gerakan mengikuti aturan nyata, jadi footage sains atau tutorial cara-kerja tetap akurat sekaligus rapi.

Contoh prompt

Klip sesuai fisika

Klip sesuai fisika

Sebuah cangkir keramik tergelincir dari meja marmer dan pecah di lantai, serpihan berhamburan, suara benturan tajam yang sinkron

Edit prompt
Urutan multi-shot

Urutan multi-shot

Kurir yang sama berjaket merah: satu shot menyusuri pasar, shot berikutnya tiba di ambang pintu yang bercahaya saat senja

Edit prompt
Kartu judul terlokalisasi

Kartu judul terlokalisasi

Hero shot merek kopi, uap mengepul dari tuangan segar, judul di layar bertuliskan ‘Freshly Roasted’ dengan tipografi tebal yang tajam

Edit prompt
Dari camcorder ke sinematik

Dari camcorder ke sinematik

Rekaman camcorder genggam sebuah pesta ulang tahun, lalu adegan yang sama tampil sebagai wide sinematik hangat dengan room tone

Edit prompt
Lanjutan klip

Lanjutan klip

Ia berbalik dari jendela dan berjalan keluar ke jalanan Tokyo yang basah oleh hujan, kamera mengikutinya tanpa terputus

Edit prompt
Produk studio

Produk studio

Sneaker avant-garde berputar di atas alas titanium, key light keras, pantulan logam yang akurat, dengungan mekanis samar

Edit prompt

Harga sederhana

Mulai gratis hari ini, dengan opsi untuk upgrade atau membatalkan kapan saja.

Basic

$9/ bulan
ditagih sebagai $0 per tahun

900 bulanan kredit

1 pengguna saja

Semua model

Workflows

Standard

$24/ bulan
ditagih sebagai $0 per tahun

3200 bulanan kredit

1 pengguna saja

Semua model

Workflows

Pro

$45/ bulan
ditagih sebagai $0 per tahun

6200 bersama bulanan kredit

1 pengguna

+ hingga 4 lainnya dengan biaya tambahan

Semua model

Workflows

Pro Max

$170/ bulan
ditagih sebagai $0 per tahun

24000 bersama bulanan kredit

1 pengguna

+ hingga 9 lainnya dengan biaya tambahan

Semua model

Workflows

Enterprise

Untuk batas yang lebih tinggi

Khusus

ketentuan harga dan penagihan

Kredit volume tinggi
Batas kursi khusus
Semua model
Workflows
Pricing Gradient

Free

Untuk bereksperimen

$0

gratis selamanya

Hingga 20 kredit
Hanya 1 pengguna
Model terbatas
Workflows

FAQ

Apa itu Flux 3?
Flux 3 adalah model fondasi multimodal dari Black Forest Labs, diumumkan pada 23 Juli 2026. Model ini belajar bersama dari gambar, video, dan audio dalam satu arsitektur terpadu, jadi satu model bisa menghasilkan video dengan audio yang sudah tersinkron dan memahami secara menyatu bagaimana dunia nyata terlihat, bergerak, dan terdengar. Generasi video mulai tersedia luas pada 4 Agustus 2026.
Flux 3 itu model gambar atau model video?
Satu model multimodal, dan video adalah bagian yang sudah dirilis. Black Forest Labs menghabiskan lebih dari 95% total komputasi pelatihannya untuk prediksi video, dan Flux 3 Video sudah tersedia luas sekarang. Flux 3 Image, Flux 3 Action untuk robotika, dan versi open-weight Flux 3 Dev sudah diumumkan dan masih dalam tahap peluncuran bertahap.
Berapa lama durasi video yang dihasilkan Flux 3?
Flux 3 menghasilkan 5 hingga 20 detik video dalam sekali proses, dalam hitungan detik penuh, atau otomatis memilih durasi yang cocok dengan prompt. Untuk karya yang lebih panjang, fitur continuation memperpanjang klip dari frame terakhirnya, dan satu generate bisa menyusun beberapa shot serta sudut kamera dengan potongan hard cut di antaranya.
Apakah Flux 3 menghasilkan audio?
Ya, dan fitur ini aktif secara default. Setiap klip dihasilkan dengan audio tersinkron dalam proses yang sama, jadi efek suara, ambience, dan dialog sudah terikat pada apa yang terjadi di layar. Suara mengikuti peristiwa fisik, sehingga benturan terdengar pas dengan tumbukannya. Anda juga bisa mematikan audio jika ingin klip yang senyap.
Mode video apa saja yang didukung Flux 3?
Ada tiga. Text-to-video bekerja hanya dari sebuah prompt. Image-to-video menerima gambar diam, baik sebagai frame pembuka maupun hingga sepuluh keyframe yang dikunci ke titik waktu tertentu. Video continuation memperpanjang klip yang sudah ada dari frame terakhirnya. Video editing serta referensi gabungan gambar, video, dan audio diumumkan akan menyusul.
Resolusi dan rasio aspek apa yang didukung Flux 3?
Flux 3 merender pada HD 720p sebagai standar, dengan Full HD 1080p tersedia lewat upscaling. Tujuh rasio aspek didukung: 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, dan 9:16, jadi satu model bisa mencakup frame lebar sinemaskop sampai potongan vertikal untuk HP.
Apa bedanya Flux 3 dengan Flux 2?
Flux 2 Pro adalah model gambar. Flux 3 adalah model fondasi multimodal yang menambahkan video dengan audio tersinkron, gerakan yang mengikuti fisika nyata, dan satu representasi bersama untuk gambar, video, dan audio. Ini adalah model video pertama dari Black Forest Labs, sementara lini Flux 2 sebelumnya berfokus pada gambar diam.
Seberapa bagus Flux 3 dibanding model video lain?
Dalam evaluasi human-rater internal Black Forest Labs saat peluncuran, Flux 3 unggul di text-to-video melawan semua model yang diuji, dan setara dengan Seedance 2.0 sambil mengungguli yang lain di image-to-video. Ini hasil internal dari pengembangnya sendiri, jadi anggap sebagai sinyal kuat, bukan benchmark independen.
Apakah Flux 3 open source?
Belum. Black Forest Labs sudah menyatakan akan merilis Flux 3 Dev, tulang punggung multimodal open-weight yang mencakup gambar, video, audio, dan prediksi aksi. Rilis open-weight ini direncanakan menyusul peluncuran API dan model private-weight, jadi bobot terbukanya baru diumumkan, belum tersedia sekarang.
Apakah Flux 3 mendukung dialog dan teks Bahasa Indonesia?
Ya. Dialog dan teks di layar multibahasa adalah salah satu fitur intinya, dengan lip-sync yang mengikuti kata yang diucapkan. Ini membuat Flux 3 relevan untuk konten yang perlu tampil dalam bahasa Indonesia, dari video produk sampai judul di layar, tanpa proses dubbing atau teks terpisah.
Bagaimana cara memakai Flux 3 di Morphic?
Flux 3 sudah berjalan di Morphic hari ini. Buka Canvas, deskripsikan shot Anda lengkap dengan satu baris tentang bagaimana suaranya, lalu generate. Karena Morphic menjalankan Flux 3 berdampingan dengan model seperti Veo, Kling, dan Seedance, Anda bisa mengirim prompt yang sama ke dua model sekaligus dan menyimpan hasil render yang paling pas.