Flux 3
oleh Black Forest Labs
World model AI dari Black Forest Labs untuk gambar, video, dan audio, dengan suara yang mengikuti aksinya.

Fitur utama
Spesifikasi teknis
5–20d
Dalam hitungan detik penuh sekali generate, atau otomatis menyesuaikan prompt
720p / 1080p
HD sebagai standar, Full HD lewat upscaling
T2V·I2V·V2V
Dari teks, dari gambar dan keyframe, atau lanjutan dari klip yang ada
Bawaan
Audio tersinkron dihasilkan bersama setiap klip, aktif secara default
Contoh penggunaan
Video beserta suara dalam sekali proses
Satu prompt langsung menghasilkan klip beserta audionya, jadi efek atau dialog sudah tersinkron sejak awal, bukan ditambahkan belakangan.
Urutan multi-shot
Susun beberapa sudut kamera dalam satu generate, atau perpanjang klip lewat continuation, sambil menjaga satu karakter tetap sama di setiap potongan.
Video produk dan merek
Material, bobot, dan pantulan cahaya tetap jujur saat kamera bergerak, sehingga produk terasa seperti hasil rekaman, bukan simulasi.
Video terlokalisasi
Dialog multibahasa dan teks di layar yang akurat memungkinkan satu adegan tayang dalam beberapa bahasa tanpa proses judul atau suara terpisah, termasuk untuk audiens berbahasa Indonesia.
Transisi yang terkoreografi
Kunci pose dan komposisi yang harus dilalui sebuah shot, lalu model menyambungkan gerakan di antaranya jadi satu take yang menyatu.
Video penjelas dengan fisika nyata
Gravitasi, tumbukan, dan gerakan mengikuti aturan nyata, jadi footage sains atau tutorial cara-kerja tetap akurat sekaligus rapi.
Contoh prompt

Klip sesuai fisika
Sebuah cangkir keramik tergelincir dari meja marmer dan pecah di lantai, serpihan berhamburan, suara benturan tajam yang sinkron
Edit prompt
Urutan multi-shot
Kurir yang sama berjaket merah: satu shot menyusuri pasar, shot berikutnya tiba di ambang pintu yang bercahaya saat senja
Edit prompt
Kartu judul terlokalisasi
Hero shot merek kopi, uap mengepul dari tuangan segar, judul di layar bertuliskan ‘Freshly Roasted’ dengan tipografi tebal yang tajam
Edit prompt
Dari camcorder ke sinematik
Rekaman camcorder genggam sebuah pesta ulang tahun, lalu adegan yang sama tampil sebagai wide sinematik hangat dengan room tone
Edit prompt
Lanjutan klip
Ia berbalik dari jendela dan berjalan keluar ke jalanan Tokyo yang basah oleh hujan, kamera mengikutinya tanpa terputus
Edit prompt
Produk studio
Sneaker avant-garde berputar di atas alas titanium, key light keras, pantulan logam yang akurat, dengungan mekanis samar
Edit promptIkhtisar
Flux 3 adalah model fondasi multimodal dari Black Forest Labs, diumumkan pada 23 Juli 2026, dengan generasi video yang mulai tersedia luas pada 4 Agustus 2026. Model ini belajar bersama dari gambar, video, dan audio dalam satu arsitektur terpadu. Hasilnya, satu model bisa merender sebuah shot yang bergerak sekaligus suara yang menyertainya, dengan pemahaman yang menyatu tentang bagaimana dunia terlihat, bergerak, dan terdengar.
Yang membuat Flux 3 berbeda
Kebanyakan generator memperlakukan tiap modalitas sebagai masalah terpisah. Flux 3 justru memperlakukan gambar, video, dan audio sebagai bukti dari satu realitas yang sama. Semuanya dilatih bersama lewat pendekatan Self-Flow milik Black Forest Labs, dengan lebih dari 95% total komputasi pelatihan dicurahkan untuk prediksi video. Hasilnya terlihat pada konsistensi fisiknya: suara pas dengan benturan, gerakan mengikuti massa, dan subjek mempertahankan identitasnya dari satu shot ke shot berikutnya. Pemahaman dunia yang sama inilah yang membuat tulang punggung modelnya bisa meluas ke prediksi aksi untuk robotika, sudah diuji pada tugas produksi nyata di Audi lewat kemitraan FLUX-mimic.
Yang sudah dan belum dirilis
Flux 3 Video adalah bagian yang sudah tersedia luas: text-to-video, image-to-video dengan keyframe, dan lanjutan dari klip yang ada, semuanya hingga 20 detik dengan audio tersinkron. Black Forest Labs juga sudah mengumumkan Flux 3 Image untuk pembuatan dan pengeditan gambar, Flux 3 Action untuk robotika, versi open-weight Flux 3 Dev, serta video editing dan referensi gabungan gambar, video, dan audio. Semua itu masih di roadmap, belum ada di tangan Anda hari ini.
Flux 3 di Morphic
Flux 3 berjalan di Morphic, berdampingan dengan model video seperti Veo, Kling, Seedance, dan Vidu, serta seluruh keluarga Flux untuk gambar. Satu prompt bisa dikirim ke dua model sekaligus dalam Canvas yang sama, cara tercepat untuk melihat langsung apakah Flux 3 memang pilihan yang pas untuk sebuah shot, termasuk saat dialognya perlu tampil dalam bahasa Indonesia, alih-alih hanya percaya pada klaim di chart peluncuran.
Harga sederhana
Mulai gratis hari ini, dengan opsi untuk upgrade atau membatalkan kapan saja.
Basic
1100 bulanan kredit
1 pengguna saja
Semua model
Workflows
Standard
3625 bulanan kredit
1 pengguna saja
Semua model
Workflows
Pro
6350 bersama bulanan kredit
1 pengguna
Semua model
Workflows
Pro Max
24650 bersama bulanan kredit
1 pengguna
Semua model
Workflows
Enterprise
Untuk batas yang lebih tinggi
Khusus
ketentuan harga dan penagihan

Free
Untuk bereksperimen
$0
gratis selamanya
FAQ
ChatGPT Images 2.5
OpenAI
Model gambar OpenAI, rilis September 2026. Detail lebih tajam, edit presisi, proses lebih cepat.
Lyria 3.5
Google DeepMind
Model musik terbaik dari Google. Lagu utuh: struktur, vokal, dan lirik.
MiniMax H3 Max Turbo
fal.ai
Tingkat cepat dari H3 racikan fal. Dua kali lebih gesit, tampilan mirip.
Inworld TTS 2
Inworld
95 suara, lebih dari 100 bahasa. Audio mulai di bawah satu detik.