Alternatives

MiniMax H3 Max 和 H3 怎么选:快,但封顶 768p

H3 Max 是 fal 后训练出来的加速版,5 秒的片子约 3 秒出,最高只到 768p。哪些镜头它够用,哪些必须回 H3 出 2K,这篇一次讲清。

10 分钟读完编辑部编辑部
MiniMax H3 Max 和 H3 怎么选:快,但封顶 768p

看到「Max」,我以为它是更大的那个。不是。

MiniMax H3 Max 是一个更快、但天花板更低的 MiniMax H3。 fal Research 拿 H3 公开出来的权重做了后训练,往速度和提示词遵循度上狠调了一轮,最高只到 768p,而标准版 H3 能上 2K。它开两个接口;标准版 H3 保留这两个,再往上加参考生视频和视频编辑。它自己在 Artificial Analysis 榜单上的那一条早就把话说破了——fal 在那儿把它登记成 MiniMax H3 Turbo(768p)。Turbo 才是老实的那个词。

这些都不说明它更差。出片比播放还快,这是实打实地改变一个下午怎么过。但名字指向一个更高的顶,规格表指向一个更低的顶,而这两者之间的落差,会悄悄弄坏一条工作流。

你手上这条镜头该用哪个

MiniMax H3 Max 和 MiniMax H3 之间怎么选,一张表就完了:

这条镜头必须…去哪做
经得起裁切、重新构图,或者放到大屏上看MiniMax H3出 2K
好几个镜头之间保住同一个人MiniMax H3参考生视频
只改已经跑通的那条素材里的一个元素MiniMax H3视频转绘
做成四秒MiniMax H3文生视频
从你手头已有的一张图出发都行图片生视频
是今天下午四十次抽卡里的一次,没有一次是终稿MiniMax H3 Max只有 fal 托管

最后一行是真的,而且这块地 H3 Max 独占。但看清它描述的是什么:一个工序阶段,不是你最后交出去的那个东西。

MiniMax H3 Max 到底快在哪

三件事,而第一件比听上去值钱。

5 秒的片子,大约 3 秒落地。 比你回看一遍还快。当出片不再是一次喝咖啡的间隙,你就不会再在脑子里先剪一遍——那个你原本拿不准的版本,直接跑就是了。一个下午下来,变的不只是速度,是你做出来的东西本身。

提示词遵循度是 fal 这一轮后训练砸下去的地方。 你按顺序写节拍,它就按顺序给你。你要画面上出现字,回来的是排好的字,不是「差不多那个意思」。

H3 之所以是 H3 的那部分全都保留:文字和图片走同一套上下文;声音和画面在同一次生成里出来,不是事后铺上去的。

规格边界,截至 2026 年 8 月 31 日:480p 或 768p,默认 768p——16:9 下是 1344×768,24 帧。5 到 15 秒。文生视频吃 21:9、16:9、4:3、1:1、3:4 和 9:16;图片生视频跟着你喂进去的那张图走,还能可选地再给一张尾帧,所以首尾帧也做得了。

768p 这个顶,什么时候会咬到你

768p 就是 1344×768,约一百万像素。H3 的 2K 是短边 1440,宽画幅下约三百七十万像素三倍半的像素,而这个差别会在四个地方现形:

  • 时间线不是 768p 的时候。 把一条 768p 丢进 1440p 的序列里,它会被拉上去。你原本喜欢的那点质感全糊掉。
  • 要裁的时候。 把一条宽画幅重新构图成方图或者竖屏,你扔掉的是本来就不够用的像素。
  • 屏幕比手机大的时候。 落地页上的主视觉,或者一台显示器,边缘就露出来了。
  • 脸和字上。 细节是 768p 最先花掉的东西。

这四条一条都不沾,那 768p 是真的够用,省下来的时间是白赚的。沾上一条,这个顶就不是规格表上的一行字了——它是你要重做一遍的原因。

能不能先用 H3 Max 抽卡,再回 H3 出 2K

这个打算看着太顺了,顺到我真的去找过那个按钮:在 768p 上便宜又快地抽,抽到满意的那版锁住,再把同一条提示词拿去跑 2K 交付。没有这个按钮,而且拦住它的是两件互相独立的事。

H3 Max 根本没有 2K,所以「出终版」意味着换回标准版 H3。而 H3 Max 是另一个模型——后训练过的,权重不一样。把同一条提示词、同一个种子交给另一个模型,你拿到的不是同一条镜头的更高分辨率版本,是另一条镜头。构图会飘,节拍的时间点会挪,你花四十次抽卡才挑出来的那个东西,不会再回来。

也别指望哪儿藏着一个放大按钮。在本站,768p 和 2K 是两次独立的生成,分开计费——这里没有「一条片子升到 2K」这条路,H3 Max 那边也没有。

所以顺序比模型更要紧:先定交付分辨率,再挑一个交得了它的模型去抽卡。 如果答案是 2K,那四十次也在 H3 上抽——用同一个模型跑 768p,这样草稿才真的能预测成片,最后一遍再把分辨率切上去。每一次尝试是贵了一点,但你选中的那条镜头留住了。这在积分上是多少,定价页写着,用我们自己的单位,不用你再按秒换算。

fal 那个速度数字,换算到你自己的排期上

下面两个都是 fal 自己给的,出自同一份 FAQ,而第二个没人引用:

片长出片耗时每一秒成片摊多少算力时间
5 秒(默认)3 秒以内约 0.5 秒
15 秒(上限)「15 秒左右」约 1.0 秒

从最短的片子到最长的片子,每一秒成片的成本大约翻了一倍。 「比实时还快」在 5 秒上成立,到 15 秒就没了——跑满长度的一次生成,花的时间和它做出来的东西差不多长。

所以老实的排期规则是按工作单元算,不是按模型算。剪 5 秒的社媒切片?那个循环是真的紧,它会改变你的下午。做 15 秒的场景?按实时预算,并且把 35 倍那个头条数字——fal 拿自己的栈对着 MiniMax 自家接口测出来的——当成一句只关于短片的话。

还有一个数很容易读错:fal 报告说那次出片里有大约 2.5 秒是 timings.inference,而它把这个字段写明是 GPU 后端上的 DiT 去噪时间。那是模型的表,不是你的表。排队、提示词处理和传输都在它外面。

想公平地测一次 H3 Max,先看这个参数

如果你正打算拿 H3 Max 和别的东西对比,先确认一个参数,否则你测出来的不是模型。

prompt_expansion_mode 在 H3 Max 的 API 上是必填。它有三档,默认那一档会在生成之前改写你的提示词,而响应里会回一个 expanded_prompt 字段,告诉你真正被送进去的是哪段文字。

取值会发生什么代价
disabled你写的字原样过去没有
balanced(默认)每次请求它自己决定改写多少大约一秒
quality完整重写成一份更丰满的脚本最多约 30 秒——大约是出片时间的十倍

两件事跟着就出来了。用默认设置做的对比,是「你的提示词在对方模型上」对「fal 改写过的你的提示词在这边」——两边都设 disabled,然后做好输出会变的准备,因为那个变化正是漏进测量里的东西。另外,如果你曾经纳闷一个「三秒模型」怎么感觉这么慢,看看是不是把它留在了 quality:三十秒的改写,架在三秒的出片前面。

不管走哪条路,值得养成的习惯是跑几次然后去读 expanded_prompt。它会告诉你,在训练它的那批人眼里,一份好脚本长什么样。然后你照那个样子自己写——提示词生成器搭出来的就是同一套结构,也正是「详细的提示词比一句话加扩写更靠谱」的原因。

第一名这件事,你自己两分钟就能核

fal 说 H3 Max 排第一,它确实排第一。这件事你两分钟能整个核完,比听我说强:

  • Design Arena 的图片生视频榜——H3 Max 1,341 Elo,基础版 MiniMax H3 紧跟在后面,1,333
  • Artificial Analysis 的带声音图片生视频榜——1,201 Elo,95% 置信区间 ±11,样本 2,177 条。归档名是 MiniMax H3 Turbo(768p),Turbo 这个名字就露在这儿。
  • fal 自己做的偏好测试,对着十二个模型——画质、提示词理解、美感三项第一。fal 跑的,在 fal 的栈上。

两个榜都是偏好 Elo:人在两条片子之间挑一条。这是真信号,但它不是能力基准。

然后把两个数字放一块儿看。八分,隔开 H3 Max 和它后训练所依据的那个模型,在同时收录两者的那个榜上。而公布置信区间的那个榜给的是 ±11。不同的榜,所以这不是一次显著性检验——但量级感是对的。能站住的结论是:在 768p 上,H3 Max 至少不比 H3 差,而且两者很接近。

再看一眼那个登记名。两个榜排的都是 768p 的输出。它们没有一句话是关于你真正要交付的那个 2K 的。

H3 Max 和开放权重是什么关系

短版本:没有 H3 Max 的权重文件,而且它不会哪天不小心就有了。

H3 的社区许可证把「模型衍生物」定义得足够宽,后训练明摆着算一个,而且它把你做出来的衍生物的所有权给了你。所以 fal 下载公开的权重、在上面训练、留下结果并且闭源提供服务——这是许可证按字面在生效,不是它漏了个口子。 这是我见过的、关于开放权重到底买到了什么的最清楚的一次演示,而那和下载包里到底有什么是两个问题。

有一条条款是往另一个方向走的,对所有人都有利。大家常引的那条地域限制,管的是仓库里发布的那个模型本身——它管的是运行权重,不是使用一个基于它搭起来的托管服务。这一条覆盖 H3 Max,也覆盖包括本站在内的每一条托管路径。这是一段概括,不是法律意见。

MiniMax H3 Max 常见问题

MiniMax H3 Max 支持 2K 吗? 不支持。只有 480p 和 768p。fal 自己的模型页会把你打发去标准版 MiniMax H3 出 2K。

MiniMax H3 Max 比 MiniMax H3 好吗? 在 768p 上,好一点点——同时收录两者的榜上差八个 Elo 分。到了 2K,这个问题不成立,因为 H3 Max 不出 2K。

MiniMax H3 Max 能做参考生视频、能保人物一致性吗? 还不能。8 月 25 日 fal 说参考生视频「本周内」到;到 8 月 31 日仍然是两个接口,MiniMax 自己的文档也还挂着「即将推出」。围着它排期之前,先数一下接口。

用 MiniMax H3 Max 要花钱吗? 它是一个付费的托管 API,在它的托管方那边有一份推广额度。如果你真正想找的是不花钱的那一层,这边什么不要钱、什么要钱写得很直白。

MiniMax H3 Max 是 MiniMax 官方模型吗? 它得到 MiniMax 认可、由双方联合发布,并且写进了 MiniMax 自己的视频生成文档。但它是 fal 做的,不是 MiniMax 做的,而且只有 fal 提供服务。

MiniMax H3 Max 最短能出多长? 五秒。MiniMax 给 H3 的规格能到四秒,本站给你的就是四秒——如果你剪短片,这一点值得知道。为什么你要的秒数不一定是你拿到的秒数是另一个、也更古怪的故事。

既然 H3 做的事更多,它为什么叫 Max? 因为 Max 说的是 fal 调出来的那个工作点——768p 下的最高速度,加上更强的提示词遵循——不是能力上限。榜单上那个名字,H3 Turbo,才是告诉你到底发生了什么的那个。


最后核对于 2026 年 8 月 31 日。 上面每一个数字都出自 fal 或 MiniMax 自己,包括那些对 H3 Max 有利的;偏好 Elo 不是能力基准——每一条都标了出处,你可以自己回去核,而不是选择相信。这个模型才四周大:参考生视频承诺的那一周已经过去了,而分辨率上限恰恰是那种会动的东西。

编辑部

作者

编辑部

minimax-h3ai.video

发布于 MiniMax H3 AI Video Generator,一个基于 MiniMax H3 的独立第三方界面。

所有文章