MiniMax H3 视频转绘
上传一条片子,MiniMax H3 照着它重做一条——换个风格、换句台词,或者从它停下的地方接着往下拍。最多三条源片,每条 2 到 15 秒,出片 4 到 15 秒。你的文件它一个字节都不动。
20 条真实提示词 · 点「试试这条」直接载入
首帧 · 2:3 · 768P四个主体,一支广告
MiniMax H3 视频转绘
对你的片子做了什么
严格说,什么都没做。这一点值得先弄清楚。
MiniMax H3 视频转绘 把你的片子当成一个条件来读,再生成一条服从它的新片。动作、取景和节奏之所以能延续下来,是因为你要求了,不是因为像素被保留了下来。最多给它三条源片,每条 2 到 15 秒、合计 15 秒,你拿回 4 到 15 秒的 768P 或 2K 成片,声音就在同一个 MP4 里。
- 源片数量
- 3
- 所有源片合计
- 15 秒
- 成片,24 fps
- 4–15 秒
- 分辨率
- 768P / 2K
源片数量
所有源片合计
成片,24 fps
分辨率
- 没有编辑接口
- 没有时间轴
- 你的文件一个都不会被改
没有任何东西被编辑。你的片子是被重做了一遍
凡是你没钉死的东西都可能动——所以下面这张对照表把「保住了什么」和「变了什么」逐条列出来。
你的片子
你的片子 · 6 秒出来的样子
[video editing] · 768P保住了取景服装节奏
变了调色材质
Runway Aleph 和 Gemini Omni Flash 有编辑接口:它们会直接改你交上去的那个文件。MiniMax H3 没有这样的接口。视频是从参考通道进去的,出来的是一条照着你的片子搭出来的新片。听上去像个缺点,直到你去看榜——H3 在视频编辑那张榜上排第一,靠的恰恰是「带完整多模态上下文重做一遍」在人们真正想要的那些改动上打得过外科手术式的编辑。
但它确实定下了这一页的规矩:凡是你没钉死的东西都可能动。落到实处就是,把那些你以为不用说的东西写下来——背景、服装、时间——因为在你说出口之前,它们都不是承重墙。把几份素材拼进一个从来不存在的场景,那是另一件活——那是参考生视频。
大家拿 MiniMax H3 视频转绘干的四件事
MiniMax H3 会在提示词里声明自己在干什么,下面这四件事就是四种不同的声明。选错,是结果跑偏最常见的原因。
换风格 —— 样子变,动作不变
[video editing]只描述新的样子,其余的别碰;凡是你提到的,都可能被改。动作和节奏是最容易保住的部分,材质和打光是最容易变的部分。
- 保住
- 动作、节奏、构图
- 会变
- 材质、打光、调色
换台词 —— 话变了,人没变
[video editing + audio reuse]台词写短一点,得塞得进你要的那几秒,否则口型对不上。
- 保住
- 人物、场景
- 会变
- 口型、台词
接着拍 —— 从片子停下的地方接上
[video continuation]你的片子是助跑;描述最后一帧之后发生了什么。
- 保住
- 主体、场景、风格
- 会变
- 接下来发生什么
搬运镜 —— 借走运镜,主体整个换掉
[reference generation]你的片子只供那段运动。描述新的主体,运镜本身一个字都别提——说两遍,你就再也分不清镜头听的是哪一条指令。
- 保住
- 运镜路径与节奏
- 会变
- 主体和场景,整个换
按官方口径,这一条叫参考生成。它讲在参考生视频那一页。
方括号里那些名字是官方的 `summary` 前缀,不是我们编的简写。换风格、换台词和接着拍还都要以 `The target video is an edited version of <Video 1>.` 开头。
你的源片得长什么样,以及哪一笔要付两遍
上面那个检查器在上传之前就把你的文件读一遍,然后告诉你是哪个数字不对,而不是只说「有问题」。
你的源片按它自己的时长计费,而且是在成片之外另算的。 2K 下进十秒、出十秒,等于收两遍。把源片剪到真正要紧的那几秒,同一次跑能省掉三分之一。
画面每边在 256 到 5,760 像素之间,宽高比要落在 0.4 到 2.5 之间——手机拍的东西几乎都已经满足。还有两条:源片会顶掉首帧尾帧控制,两者不能同时用;输出永远是 24 fps。完整费率在价格页。
你片子的音轨会跟着一起进来
上传一条片子,它的声音也一并成了条件,不管你是不是有意的。
这就是为什么一个你从没上传过的声音会出现在结果里,而且它把性别和口音一起带了进来。一段从女性那里录来的笑声,落在男性脸上,听起来仍然是女性的笑声。
整条留下
原来的音轨就是成片的音轨。
fully_copy留着垫在新台词下面
音乐留下来,垫在你写的台词底下。
partially_copy只要动作
音频被丢掉,片子只以动作为条件。
weak_reference
这是 H3 会读的八个保留标记里的三个;另外五个在你从零搭一个场景的时候更要紧。
MiniMax H3 视频转绘排在哪,以及什么时候别用它
Artificial Analysis 做的是盲测两两对比,投票数公开。这是「视频编辑(带声音)」榜 2026-08-14 的快照。
- 第一名(名次区间 1–2)
#1
9001500- Elo
- 1,127
- 95% CI
- ±6
- 票数
- 11,474
- 名次区间
- 1–2
引用之前先把这一行读完:Gemini Omni Flash 只落后三分,1,124,而且区间是重叠的。那是平手,不是胜出。站得住的说法要窄一些,也更有用——H3 是那张榜上唯一的开源权重模型,而且它在榜首。
什么时候该换别的:Runway Aleph 2.0 在这里排第六,但它是在你的文件上做真正的编辑,而且能吃更长的片子。如果你要的是对一段不能被重画的素材做一处外科手术式的改动,那就该用它。
H3 横向对比把其余的都过了一遍。
Artificial Analysis · 视频编辑(带声音)· 2026-08-14 快照
上传别人的素材之前
换台词会让画面里一个真实的人说出他没说过的话。这是本站风险最高的一个控件。
- 肖像让一个真实的人说出他从没说过的话,可能违法,而且未经本人同意就这么做违反我们的条款。
- 声音音色参考会克隆某个特定的人听起来是什么样。用你自己的、有授权的,或者合成的。
- 版权上传你并不拥有的素材或音乐,不会把任何权利转到成片上。回去查源素材的授权。
- 内容审核MiniMax 会自动筛查提交的媒体;误判和漏判都会发生。
- 标注你发到哪儿,就按那儿的标注规则来。
怎么在 MiniMax H3 上跑视频转绘
H3 不会编辑你的文件。它读一遍,再生成一个新的——所以任务类型必须一上来就声明清楚。
最多传三条源片
每条 2 到 15 秒,合计 15 秒。MP4 或 MOV,H.264 或 H.265。
≤3 条,合计 ≤15 秒声明这次干什么
视频编辑、音轨复用、从最后一帧往下续拍,或者参考生成。选哪个,决定模型保住什么。
四种任务类型决定音轨怎么办
整条留下、垫在新台词下面,或者只取动作、让 H3 重写一套声音。
三条音轨走法生成那个新文件
出片 4 到 15 秒,24 fps,768P 或 2K,配 32 kHz 立体声。你的源片一个字节没动。
出来的是一个新 MP4
输入视频的秒数,按你套餐里跟成片一样的每秒费率计费。
MiniMax H3 视频转绘常见问题
十个回答 · 全部摊开 · 一条都不折叠
