Flux 3
由 Black Forest Labs 提供
Black Forest Labs 面向图像、视频、音频的世界模型,声音精准对上画面动作。

核心功能
技术规格
5–20 秒
单次生成整数秒时长,也可以让模型按提示词自动决定
720p / 1080p
默认高清,超分辨率可到全高清
T2V·I2V·V2V
文本、图像加关键帧,或接续已有片段
原生
每个片段都同步生成音频,默认开启
应用场景
一次生成画面加声音
一条提示词同时返回视频和音频,音效或台词已经对上动作,不用再后期补配。
多镜头序列
一次生成里排好几个不同机位,或用接续功能延长片段,让同一角色贯穿每个镜头。
电商与品牌短片
镜头运动时材质、重量和反光都保持真实,产品看起来像实拍,不像合成。
短剧出海与多语言配音
多语言对白加准确的屏幕文字,一段素材就能配出多种语言版本,省下另开一轮配音或加字幕的工序,正合短剧出海这类场景。
编排好的转场
把镜头要经过的姿态和构图先钉住,模型会把中间的动作补成一条连续长镜头。
带真实物理的科普片
重力、碰撞和运动都遵循真实规则,讲科学原理的画面既准确又干净。
提示词示例






概述
Flux 3 是 Black Forest Labs 于 2026 年 7 月 23 日发布的多模态基础模型,视频生成已在 2026 年 8 月 4 日正式开放。它在一个统一架构里联合学习图像、视频和音频,因此单个模型既能渲染一段会动的画面,也能配上属于它的声音,对真实世界的外观、运动、声音保持一致理解。
Flux 3 和其他模型的区别
大多数生成器把每种模态当成独立问题分开处理。Flux 3 不一样,它把图像、视频、音频都看作同一个底层现实的证据,用 Black Forest Labs 自研的 Self-Flow 方法一起训练,超过 95% 的训练算力投在了视频预测上。这种训练方式换来的是物理一致性:声音对上撞击的瞬间,动作服从质量,主体从一个镜头到下一个镜头都保持同一副面孔。同样这种对世界的理解,也让这套底座能延伸到机器人的动作预测,Black Forest Labs 通过 FLUX-mimic 合作已经在 Audi 的真实生产任务上做了测试。
已经上线的,和还没上线的
Flux 3 视频是目前正式开放的部分:文本到视频、带关键帧的图像到视频、接续已有片段,最长可以做到 20 秒,且都自带同步音频。Black Forest Labs 还宣布了用于图像生成和编辑的 Flux 3 图像、面向机器人的 Flux 3 Action,以及开放权重的 Flux 3 Dev,视频编辑和图像、视频、音频组合参考也在计划之中。这些暂时还停留在路线图上,还不能直接用。
Morphic 上的 Flux 3
Flux 3 已经在 Morphic 上线,和 Veo、可灵、Seedance、Vidu 等视频模型,以及 Flux 家族的图像模型放在同一个工作区。一条提示词可以同时发给两个模型对比效果,这比只看发布会的跑分图,更能判断 Flux 3 适不适合某个具体镜头。
简单定价
今天就免费开始,随时可以升级或取消。
Basic
1100 每月 信用
1 个用户
所有模型
工作流
Standard
3625 每月 信用
1 个用户
所有模型
工作流
Pro
6350 共享 每月 信用
1 用户
所有模型
工作流
Pro Max
24650 共享 每月 信用
1 用户
所有模型
工作流
Enterprise
更高的限制
自定义
定价和账单条款

Free
供随意体验
$0
永久免费