视频生成

MiniMax H3 Max

由 fal.ai 提供

fal后训练的MiniMax H3。
更贴合提示词,为速度重建。

MiniMax H3 Max

核心功能

技术规格

MiniMax H3

由fal基于H3的公开权重后训练。

2种模式

文生视频和图生视频,两种都已开放。

5至15秒

建议使用5到10秒。

最高768p

原生480p和768p,比720p HD高一档。

24 FPS

电影和电视拍摄使用的帧率。

原生

立体声与画面同时生成。

11种语言

继承自H3,在11种语言上稳定。

6种比例

支持21:9、16:9、4:3、1:1、3:4和9:16。

应用场景

动态文字排版

画出的笔迹收拢成可读的字形并停住。无论拉丁字母还是日文,拼写都不会散掉。

等距3D搭建

地块升起,楼体拉高,道路连通,产品讲解或数据故事就在画面上自己搭起来。

技术图解

线稿自己长出来:平面图立起成等距视角,随后尺寸标注和批注逐一浮现。

拼贴与剪纸

毛边纸片和网点印刷质感滑入画面,扣合成主体形状,看上去像手工做出来的。

孔版印刷质感

双色油墨、粗网点,加上刻意的套印偏移,就像第二次过版时轻轻错开的样子。

由声音带起来的场景

画面和声音一起生成,围绕一个具体声响搭的镜头,返回时就已经带着那个声响。

提示词示例

竹编工坊

匠人把竹篾一根根压进筐沿,指腹蹭过毛刺

Edit prompt

活字印刷

细线在方格纸上一笔笔拼成一行粗体标题

Edit prompt

清晨早市

卷帘门升起,蒸汽顺着窄巷淌出来

Edit prompt

茶山采摘

指尖掐下嫩芽,晨雾在梯田间一层层散开

Edit prompt

皮影戏

影人在白幕后转身,灯影在竹竿上抖了一下

Edit prompt

船闸

一艘货船缓缓挤进闸室,水面慢慢抬起来

Edit prompt

概览

MiniMax H3 Max是fal做出来的MiniMax H3后训练版本。MiniMax在2026年8月公开了H3,fal把这份权重重新训练,让它更贴合提示词、画面更耐看,再接上自家的推理链路。返回的是5到15秒的片段,最高768p,24fps,声音与画面同时生成,是立体声。

名字为什么容易误会

Max听起来像一个画质档位,就像别处的Pro,而且这个模型挂在MiniMax名下。两点都不准确。它是第三方对一个公开模型做的调校版本,不是MiniMax推出的更大或更精细的H3。想通这一层,最让人意外的那条参数也就说得通了:它的分辨率上限比它所源自的模型更低,而不是更高。

这个上限从哪来

H3分三部分交付。预处理读取提示词,把它改写成结构化的形式。基础模型据此按短边768像素渲染。第三个模块再把结果重新生成为2K,并且会再看一次原始提示词,让细节和小字是被还原出来,而不是靠猜。MiniMax公开的是中间那一部分。所以后训练出来的版本继承的是原生768p的生成能力,后面没有2K环节。这就是这个模型做的取舍:放弃高分辨率的收尾,把全部余量押在768p出得有多快上。

速度改变了什么

半分钟一次的生成,是提交完就走开的事。几秒一次,它就变成可以反复打磨的事,这个转变比数字本身更要紧。二十版广告开场可以当作成片的动态来判断,而不是当作分镜。一个镜头摆好、看一遍、调一次、再看一遍,都能在一次坐下的时间里完成。那些原本不值得等的尝试,比如去试一个自己也只信一半的方向,成本低到可以直接试。

分辨率降下来,是为此付出的代价,这一点不必回避。做信息流内容、课程、内部剪辑,或者任何通往成片路上的草稿,768p够用。要做母版就不够,这时候回到它所源自的那个模型,是顺理成章的下一步。

在Morphic上使用MiniMax H3 Max

在视频模型选择里,MiniMax H3 Max和MiniMax H3、Seedance、Kling、Veo排在一起。把镜头写成一份说明,生成,结果落在Canvas上,您可以把同一份说明再跑一个模型,并排比较。这个模型奖励的两个习惯,写清动作在整段片子里怎么走而不是描述一张静帧,以及像调度画面一样调度声音,在别的模型上同样管用。

简单定价

今天就免费开始,随时可以升级或取消。

Basic

$9/
账单金额为 $0 每年

1100 每月 信用

1 个用户

所有模型

工作流

Standard

$24/
账单金额为 $0 每年

3625 每月 信用

1 个用户

所有模型

工作流

Pro

$45/
账单金额为 $0 每年

6350 共享 每月 信用

1 用户

+ 最多 4 人额外付费可增加

所有模型

工作流

Pro Max

$170/
账单金额为 $0 每年

24650 共享 每月 信用

1 用户

+ 最多 9 人额外付费可增加

所有模型

工作流

Enterprise

更高的限制

自定义

定价和账单条款

大容量信用
自定义席位限制
所有模型
工作流
Pricing Gradient

Free

供随意体验

$0

永久免费

最多 20 积分
仅1个用户
部分模型
工作流

常见问题

MiniMax H3 Max是什么?
MiniMax H3 Max是MiniMax H3的后训练版本,做出它的是fal,不是MiniMax。fal拿到H3的公开权重,用自有数据重新训练,让它更贴合提示词、画面更耐看,然后放在自己的硬件上提供服务。生成结果是5到15秒的片段,最高768p,自带原生立体声。
MiniMax H3 Max是MiniMax官方发布的吗?
不是,这个名字容易让人误会。H3由MiniMax开发并公开权重,把这份权重后训练成H3 Max并独家托管的是fal。MiniMax从未发布过叫这个名字的模型。所以H3 Max是fal基于一个公开的MiniMax模型做出的自有版本,既不是MiniMax的发布,也不是H3的官方高配档。
MiniMax H3 Max和MiniMax H3有什么区别?
三点。H3 Max在基础权重之上做了后训练,目标是提示词贴合度和画面质感。它偏向速度而不是最高分辨率,停在768p,而H3能到2K。它只覆盖文生视频和图生视频,H3还有一条用混合图片、片段和音频做参考生成的路。
MiniMax H3 Max有多快?
在768p的5秒片段上,fal的目标是文生视频3秒内返回,而视频生成通常需要30秒到几分钟。它跑在fal的多节点推理引擎上,多台机器一起处理同一个请求。提示词扩展请保持balanced:更慢的quality档会多花大约30秒,等于把这份速度优势原样还回去。
MiniMax H3 Max除了文生视频,也能图生视频吗?
两条都已开放。文生视频把写好的场景变成片段。图生视频让您提供的静态图动起来,同一个模式也接受首帧和尾帧,于是动作在您挑的两张图之间完成。第三种模式是参考生视频,用来保持人物一致,官方说明是稍后推出。
MiniMax H3 Max为什么停在768p?
因为公开权重能生成的就是768p。H3是三段式结构:一段预处理负责解读提示词,一个基础模型按768p渲染,另有独立的一段把结果重新生成为2K。MiniMax只公开了基础模型,所以从这份权重后训练出来的模型,后面根本没有可以交接的2K环节。
MiniMax H3 Max能生成声音吗?
能。底层模型把画面和声音一起预测,而不是生成完片段再配音,所以一次生成返回的画面自带立体声。这也让声音值得写进提示词:把想要的音效、环境声,以及某个声音落点的准确时刻都写清楚,比事后一层层去铺要省事。
可以在Morphic上使用MiniMax H3 Max吗?
可以。在模型选择里选MiniMax H3 Max,把提示词栏切到视频,然后把这条镜头当作一份说明来写:主体、动作、运镜、光线,以及您想要的声音。生成结果会落在Canvas上,您可以把同一条说明再跑一个模型,并排比较之后再决定用哪个。