多模态

Flux 3

由 Black Forest Labs 提供

Black Forest Labs 面向图像、视频、音频的世界模型,声音精准对上画面动作。

Flux 3

核心功能

技术规格

5–20 秒

单次生成整数秒时长,也可以让模型按提示词自动决定

720p / 1080p

默认高清,超分辨率可到全高清

T2V·I2V·V2V

文本、图像加关键帧,或接续已有片段

原生

每个片段都同步生成音频,默认开启

应用场景

一次生成画面加声音

一条提示词同时返回视频和音频,音效或台词已经对上动作,不用再后期补配。

多镜头序列

一次生成里排好几个不同机位,或用接续功能延长片段,让同一角色贯穿每个镜头。

电商与品牌短片

镜头运动时材质、重量和反光都保持真实,产品看起来像实拍,不像合成。

短剧出海与多语言配音

多语言对白加准确的屏幕文字,一段素材就能配出多种语言版本,省下另开一轮配音或加字幕的工序,正合短剧出海这类场景。

编排好的转场

把镜头要经过的姿态和构图先钉住,模型会把中间的动作补成一条连续长镜头。

带真实物理的科普片

重力、碰撞和运动都遵循真实规则,讲科学原理的画面既准确又干净。

提示词示例

物理真实片段

物理真实片段

一只陶瓷马克杯从大理石台面滑落,摔碎在地上,碎片四溅,尖锐的撞击声同步响起

Edit prompt
多镜头序列

多镜头序列

同一位穿红夹克的快递员:一个镜头穿行市集,下一个镜头在黄昏抵达一扇亮灯的门前

Edit prompt
多语言标题卡

多语言标题卡

咖啡品牌主视觉,热气从刚倒出的咖啡上升起,屏幕标题以清晰粗体写着「Freshly Roasted」

Edit prompt
家用摄像机变电影感

家用摄像机变电影感

手持家用摄像机拍下的生日派对画面,同一场景随后变成暖调电影感宽镜头,带房间环境音

Edit prompt
片段接续

片段接续

她从窗边转身,走进被雨光映亮的东京街头,镜头一镜到底跟随,没有切换

Edit prompt
影棚产品

影棚产品

前卫运动鞋在钛金属基座上旋转,硬质主光,金属反光准确,隐约传来机械嗡鸣声

Edit prompt

简单定价

今天就免费开始,随时可以升级或取消。

Basic

$9/
账单金额为 $0 每年

900 每月 信用

1 个用户

所有模型

工作流

Standard

$24/
账单金额为 $0 每年

3200 每月 信用

1 个用户

所有模型

工作流

Pro

$45/
账单金额为 $0 每年

6200 共享 每月 信用

1 用户

+ 最多 4 人额外付费可增加

所有模型

工作流

Pro Max

$170/
账单金额为 $0 每年

24000 共享 每月 信用

1 用户

+ 最多 9 人额外付费可增加

所有模型

工作流

Enterprise

更高的限制

自定义

定价和账单条款

大容量信用
自定义席位限制
所有模型
工作流
Pricing Gradient

Free

供随意体验

$0

永久免费

最多 20 积分
仅1个用户
部分模型
工作流

常见问题

什么是 Flux 3?
Flux 3 是 Black Forest Labs 于 2026 年 7 月 23 日发布的多模态基础模型。它在一个统一架构里联合学习图像、视频和音频,因此单个模型就能生成带同步音频的视频,并对真实世界的外观、运动、声音保持一致理解。视频生成已于 2026 年 8 月 4 日正式开放。
Flux 3 是图像模型还是视频模型?
它是一个多模态模型,目前已经上线的部分是视频。Black Forest Labs 把超过 95% 的训练算力投在视频预测上,Flux 3 视频现已正式开放。Flux 3 图像、面向机器人的 Flux 3 Action,以及开放权重的 Flux 3 Dev 都已宣布,仍在陆续推出中。
Flux 3 生成的视频有多长?
Flux 3 单次生成 5 到 20 秒,按整数秒计,也可以交给模型自动决定合适的时长。要做更长的作品,可以用接续功能从片段的最后几帧继续延伸,一次生成还能排好几个镜头和机位,中间用硬切衔接。
Flux 3 会生成音频吗?
会,而且默认开启。每个片段都在同一次生成里配好同步音频,特效、环境音和台词从一开始就对上画面里发生的事。声音会跟着物理事件走,撞击声正好落在击打的瞬间。也可以关掉音频,只生成无声片段。
Flux 3 支持哪些视频模式?
三种。文本到视频只靠一条提示词。图像到视频可以传入静帧,作为开场画面,或钉住最多十张关键帧对应不同时间点。视频接续会从已有片段的最后几帧继续生成。视频编辑,以及图像、视频、音频组合参考,官方已宣布即将上线。
Flux 3 支持什么分辨率和画幅比例?
Flux 3 默认渲染 720p 高清,通过超分辨率可以做到 1080p 全高清。支持七种画幅比例:21:9、2:1、16:9、4:3、1:1、3:4 和 9:16,从电影宽银幕到竖屏手机短片都能覆盖。
Flux 3 支持中文对白和文字吗?
支持。Flux 3 的多语言对白和屏幕文字功能能准确渲染包括中文在内的多种语言,口型也会对上台词,这也是它能配上多语种字幕、直接支持短剧出海的原因。同一段素材不用另开一轮配音或加字幕流程,就能出多语言版本。
Flux 3 生成的视频可以商用吗?
商用权限以 Black Forest Labs 的许可条款和你所用平台(比如 Morphic)的服务条款为准,具体范围会随模型版本调整。正式商用前,建议先核对当前条款里关于生成内容授权范围的最新说明。
Flux 3 和 Flux 2、其他视频模型比怎么样?
Flux 2 Pro 是一个图像模型,Flux 3 则是多模态基础模型,多了带同步音频的视频、合乎真实物理的动作,以及图像、视频、音频共用的一套表征,是 Black Forest Labs 的第一个视频模型。在官方发布时的人工评测里,Flux 3 的文本到视频效果领先所有参与对比的模型,图像到视频与 Seedance 2.0 打平并领先其余对手,这是厂商自己的内部评测结果,可以当作强烈信号,但不等同于第三方独立跑分。
怎么在 Morphic 上用 Flux 3?
Morphic 现在就能用 Flux 3。打开 Canvas,用一句话描述镜头该有什么画面和声音,然后生成。Morphic 把 Flux 3 和 Veo、可灵、Seedance 这些模型放在一起,同一条提示词可以发给其中两个模型,留下效果更好的那条。