多模态
Flux 3
由 Black Forest Labs 提供
Black Forest Labs 面向图像、视频和音频的世界模型,声音与画面动作精准对应。

核心功能
技术规格
图像·视频·音频
在一个模型中联合学习;并可延伸到动作预测
最长 20 秒
单次生成的视频时长;串接片段可得到更长的序列
原生
每个视频片段都同步生成配套音频
Self-Flow
Black Forest Labs 的统一多模态架构
应用场景
一次生成带声音的视频
一条提示词同时返回画面和音频,特效或台词已经与动作同步,无需事后再加。
多镜头序列
把片段串接成更长的场景,用一张视觉参考让同一角色贯穿每一次剪辑,从短片到长片都可以。
产品与品牌影片
镜头移动时材质、重量和反光都保持真实,产品看起来是实拍而非模拟。
本地化视频
多语言对白和准确的屏幕文字让同一场景以多种语言交付,无需单独做标题或配音。
图像生成与编辑
跨风格、跨宽高比合成图像,渲染清晰的多语言文字,再原地编辑某一个区域,无需整体重做。
带真实物理的科普讲解
重力、碰撞和运动都遵循真实规则,科学和原理演示画面既准确又干净。
提示词示例






简单定价
今天就免费开始,随时可以升级或取消。
Basic
$9/ 月
账单金额为 $0 每年900 每月 信用
1 个用户
所有模型
工作流
Standard
$24/ 月
账单金额为 $0 每年3200 每月 信用
1 个用户
所有模型
工作流
Pro
$45/ 月
账单金额为 $0 每年6200 共享 每月 信用
1 用户
+ 最多 4 人额外付费可增加
所有模型
工作流
Pro Max
$170/ 月
账单金额为 $0 每年24000 共享 每月 信用
1 用户
+ 最多 9 人额外付费可增加
所有模型
工作流
Enterprise
更高的限制
自定义
定价和账单条款
大容量信用
自定义席位限制
所有模型
工作流

Free
供随意体验
$0
永久免费
最多 20 积分
仅1个用户
部分模型
工作流
常见问题
什么是 Flux 3?
Flux 3 是 Black Forest Labs 于 2026 年 7 月 23 日发布的多模态基础模型。它在一个统一架构中联合学习图像、视频和音频,因此一个模型就能生成带原生音频的视频、合成与编辑图像,并保持对真实世界外观、运动和声音的一致理解。
Flux 3 是图像模型还是视频模型?
两者都是。Flux 3 是一个多模态模型,而不是几个独立工具。它既生成和编辑图像,也生成带同步原生音频的视频,全部出自同一个世界模型。Black Forest Labs 还通过 FLUX-mimic 合作把这一主干延伸到机器人的动作预测,并在 Audi 的真实生产任务上做了测试。
Flux 3 的视频有多长?
Flux 3 单次生成最长 20 秒的视频。要制作更长的作品,可以把片段串接成多镜头序列,并复用同一张视觉参考,让角色在可长达数分钟的多个场景间保持一致。每个片段返回时都已带上与动作匹配的同步原生音频。
Flux 3 会生成音频吗?
会。每个 Flux 3 视频都在同一次生成中配上原生音频,因此特效、环境音和对白已经与屏幕上发生的事同步。声音与物理事件绑定,撞击声与击打瞬间对应,而且 Flux 3 支持多语言对白,让一个场景能以不止一种语言说话。
Flux 3 能编辑图像和视频吗?
能。Flux 3 对两者都支持情境内编辑。你可以改动图像中的某一个元素而保持画面其余部分不变,或把主体从源视频带入新场景。它延续了 Flux Kontext 的指令式编辑血统,而后者已经在 Morphic 上驱动图像编辑。
Flux 3 与 Flux 2 有何不同?
Flux 2 Pro 是一个图像模型。Flux 3 是一个多模态基础模型,新增了带原生音频的视频、符合真实物理的动态,以及跨图像、视频和音频的一套共享表征。文字渲染和提示词理解也显著提升,因此 Flux 3 是一个世界模型,而 Flux 2 聚焦于静态图像。
Flux 3 开源吗?
Black Forest Labs 表示将发布 Flux 3 Dev,这是一个覆盖图像、视频、音频和动作预测的开放权重多模态主干,并会同时推出更快的版本。开放权重发布计划安排在 API 与私有权重模型的早期体验推出之后,因此开放权重是即将到来,而非发布即可用。
我如何在 Morphic 上使用 Flux 3?
Flux 家族已经通过 Flux 2 Pro 和 Kontext 编辑在 Morphic 上驱动图像工作,同时还有 Nano Banana Pro、Seedream 5 等模型。打开 Morphic,描述你想要的内容,在 Canvas 上生成,并将多个模型并排比较,留下最适合你镜头的那一张。