Fitur dan kemampuan Flux 3
Flux 3 adalah model fondasi multimodal dari Black Forest Labs. Alih-alih satu model terpisah per output, model ini mempelajari gambar, video, dan audio bersama-sama, jadi satu prompt bisa mengembalikan shot yang bergerak dan bersuara yang berperilaku seperti dunia nyata.
Black Forest Labs mengumumkan Flux 3 pada 23 Juli 2026 dan meluncurkannya lewat early access. Kemampuan di bawah ini adalah yang telah mereka jelaskan; panduan prompt yang menyusul adalah praktik umum untuk model video beraudio bawaan, dan tuas persisnya bisa mengeras saat Flux 3 tersedia luas.
| Fitur | Yang dilakukan | Paling cocok untuk |
|---|---|---|
| Video beraudio bawaan | Menghasilkan klip dan suara tersinkronisasinya dalam sekali proses | Adegan bersuara, dialog, efek |
| Fisika dunia nyata | Gerakan mematuhi massa dan momentum; suara cocok dengan benturan | Film produk, aksi, video penjelas |
| Karakter konsisten | Mempertahankan subjek di berbagai shot dari referensi visual | Urutan, seri, karya merek |
| Teks dan ucapan multibahasa | Merender teks di layar dan dialog yang akurat | Video terlokalisasi, judul, caption |
| Pengeditan dalam konteks | Mengubah satu elemen tanpa render ulang penuh | Memperbaiki take, revisi bertarget |
| Perangkaian multi-shot | Menyambung klip menjadi urutan panjang yang bersambung | Film pendek, iklan, reveal |
Video beraudio bawaan
Poin utamanya adalah gambar dan suara datang bersamaan. Flux 3 menghasilkan setiap klip dengan audio bawaan yang tersinkronisasi dalam proses yang sama, jadi benturan, langkah kaki, atau dialog sudah terikat pada aksinya, bukan ditumpuk belakangan. Sebutkan suara yang Anda inginkan di prompt, dan atur bahasa saat adegan punya dialog.
Fisika dunia nyata
Flux 3 mempelajari gerakan, massa, dan suara sebagai satu sistem, jadi bobot, momentum, dan tumbukan mengikuti aturan nyata dan material menjaga tampilannya saat kamera bergerak. Jelaskan bagaimana gerakan berkembang sepanjang shot, dan fisikanya terasa seperti hasil rekaman alih-alih melenceng.
Karakter konsisten
Berikan referensi visual yang jelas dan Flux 3 membawa wajah, pakaian, dan tampilan yang sama dari shot ke shot. Pakai ulang referensi itu di setiap potongan untuk mempertahankan karakter sepanjang urutan yang berjalan bermenit-menit, dan itulah yang membuat sebuah seri tetap dikenali alih-alih mengulang dari nol di tiap adegan.
Teks multibahasa dan pengeditan dalam konteks
Rendering teks meningkat signifikan dibanding Flux sebelumnya, termasuk teks di layar yang akurat dalam berbagai bahasa, jadi sebuah kartu judul terbaca benar tanpa proses terpisah. Pengeditannya bertarget: ubah satu elemen dari sebuah frame, atau bawa subjek dari klip sumber ke adegan baru, dan sisanya tetap utuh.
Contoh penggunaan Flux 3
Adegan beraudio bawaan
Klip kembali dengan suaranya sudah tersinkron, jadi efek atau dialog jatuh tepat bersama aksinya alih-alih take bisu yang Anda perbaiki belakangan.
Film produk dan merek
Pantulan, bobot, dan material tetap jujur saat kamera bergerak, jadi tuangan, putaran, atau jatuhan terasa seperti hasil rekaman, bukan simulasi.
Urutan multi-shot
Rangkai klip menjadi adegan yang lebih panjang dan pertahankan satu karakter di setiap potongan lewat referensi visual, jadi urutannya tetap konsisten.

Video terlokalisasi
Dialog multibahasa dan teks di layar yang akurat memungkinkan satu adegan dirilis dalam beberapa bahasa, tanpa perlu proses judul atau suara terpisah.

Pembuatan dan pengeditan gambar
Hasilkan berbagai gaya dan rasio aspek, render teks yang tajam, lalu edit satu area di tempat tanpa mengulang seluruh gambar.

Video penjelas dengan fisika nyata
Gravitasi, tumbukan, dan gerakan mengikuti aturan nyata, jadi footage cara-kerja tetap akurat sekaligus rapi.
Cara membuat prompt Flux 3
Tulis prompt sebagai brief shot singkat, bukan caption. Telusuri SPACE, dan karena Flux 3 membuat suara bersama gambar, selalu sertakan satu cue audio.
| SPACE | Sertakan | Contoh |
|---|---|---|
| Subject | Siapa atau apa yang ada di frame, dijelaskan secara konkret | Seorang kurir berjaket hujan merah |
| Performance | Gerakannya: apa yang dilakukan subjek, dan bagaimana | Dia menyelinap di antara lapak pasar, napasnya mengembun |
| Ambience | Setting, waktu, dan cahaya | Pasar malam yang basah oleh hujan, batu basah di bawah kaki |
| Camera | Jenis shot plus satu gerakan | Low tracking shot, push-in yang mantap |
| Extra cues | Audio, bahasa, timing | Hujan dan obrolan jauh, satu dialog dalam bahasa Jepang |
Kesalahan umum
- Mendeskripsikan gambar diam. Model video butuh gerakan dari waktu ke waktu, bukan foto dalam kata-kata.
- Melupakan suara. Flux 3 menghasilkan audio, jadi sebutkan efek, ambience, atau dialog yang Anda inginkan.
- Menjejalkan satu urutan ke dalam satu prompt. Jaga satu aksi yang jelas per take, dan rangkai klip untuk panjangnya.
- Membiarkan referensi tanpa label. Sebutkan untuk apa setiap referensi agar model tahu mana yang menggerakkan adegan.
Untuk daftar kemampuan lengkap dan spesifikasi, lihat halaman model Flux 3.
