Flux 3
Black Forest Labs 提供
Black Forest Labsが手がける画像・動画・音声のワールドモデル。
動きに合わせて音まで生成します。

主な機能
技術仕様
5〜20秒
1回の生成で丸秒単位。プロンプトに合わせた自動設定も可能
720p / 1080p
標準はHD、アップスケールでフルHDまで対応
T2V・I2V・V2V
テキストから、画像とキーフレームから、既存クリップの続きから、いずれも生成可能
ネイティブ
すべてのクリップで同期音声を標準生成
活用事例
音声付き動画を1回の生成で
プロンプトを送るだけでクリップと音声が同時に返ってくるので、あとから効果音を足す手間がありません。
マルチショットのシーケンス
1回の生成で複数アングルをまとめて組み立てられます。継続生成でクリップを延ばせば、1人のキャラクターをカットをまたいで保てるので、配信のワンシーンやキャラクターものの映像にも向きます。
商品・ブランドムービー
カメラが動いても素材の質感や光の反射が崩れないので、ECサイトや広告用の商品映像がCGではなく実写のように仕上がります。
多言語対応の映像展開
セリフと画面テキストが言語ごとに正しく描画されるため、日本語版を含む複数言語のバージョンを、タイトルや音声を作り直さずに1シーンから展開できます。
振り付けされたトランジション
ショットが通過すべきポーズと構図をキーフレームで指定すれば、その間の動きをモデルがひとつのカットとしてつなぎます。
物理法則に沿った解説映像
重力や衝突、動きが現実のルールに従うので、理科系やしくみ解説の映像でも見た目と正確さを両立できます。
プロンプト例






Overview
Flux 3はBlack Forest Labsのマルチモーダル基盤モデルです。2026年7月23日に発表され、動画生成は8月4日に一般公開されました。画像・動画・音声をひとつの統合アーキテクチャで学習しているのが特徴で、1つのモデルが映像とその音を同時に生成しながら、世界の見え方・動き方・鳴り方について一貫した理解を保ちます。
Flux 3が他と違う理由
多くの生成モデルは画像・動画・音声を別々の問題として扱います。Flux 3はこの3つを、ひとつの現実についての手がかりとして一緒に学習させています。使われているのはBlack Forest LabsのSelf-Flowという手法で、学習計算資源の95%以上が動画予測に充てられました。その成果は精度として表れます。音は衝撃の瞬間に合い、動きは質量に従い、被写体はショットをまたいでも同一人物に見えます。この世界理解の深さが、バックボーンをロボティクスの行動予測にまで広げる土台にもなっており、FLUX-mimicパートナーシップを通じてAudiの実運用タスクでも検証されています。
公開済みの機能と、これから来る機能
すでに一般提供されているのはFlux 3 Videoです。テキストからの生成、キーフレームを使った画像からの生成、既存クリップの継続生成のいずれも、最大20秒まで同期音声付きで対応します。加えて、画像生成・編集用のFlux 3 Image、ロボティクス向けのFlux 3 Action、オープンウェイト版のFlux 3 Dev、そして動画編集や画像・動画・音声を組み合わせた参照生成が発表されています。これらは今後のロードマップであり、現時点で使えるのは動画の部分です。
MorphicでのFlux 3
Flux 3はMorphic上で、Veo、Kling、Seedance、Viduといった動画モデル、そしてFluxファミリーの画像モデルと並んで動きます。同じCanvas上で1つのプロンプトを複数のモデルに送れるので、発表時の比較表を鵜呑みにするより先に、実際の自分のショットでFlux 3が合うかどうかを確かめられます。
シンプルな料金体系
今すぐ無料で始めて、いつでもアップグレードまたはキャンセルできます。
Basic
1100 月 クレジット
1 ユーザーのみ
すべてのモデル
ワークフロー
Standard
3625 月 クレジット
1 ユーザーのみ
すべてのモデル
ワークフロー
Pro
6350 共有 月 クレジット
1 ユーザー
すべてのモデル
ワークフロー
Pro Max
24650 共有 月 クレジット
1 ユーザー
すべてのモデル
ワークフロー
Enterprise
より高い制限のために
カスタム
料金と請求条件

Free
気軽に試したい方に
$0
ずっと無料