同一角色视频生成

没有哪个视频模型会在两次请求之间记住你的角色,说自己记得的,其实是替你存了个文件再交回来。既然如此,那个要先训练的形象就可以跳过:把静帧、片段和声音直接挂在你要的这个镜头上,一次最多十二个文件。
第一条免费,不用绑卡。

写下一个镜头

0 / 7000

This run spends credits — the free clip is 4s · 768P · 16:9.

Sign up free and your first MiniMax H3 clip renders 4s · 768P · 16:9, with sound. A plan raises the ceiling to 15s, 2K and four at a time — the free clip is a size, not a different model.

  • 给角色一个文件,别给形容词——一张正面静帧永远比一段描述管用
  • 说清每个文件负责什么:这张是脸,这段是动作,这条是声音
  • 把不能变的特征点名:头发、外套、疤痕。没点名的,模型都可以重画
  • 一场戏是一个镜头一次请求,同一批参考文件每次都要重新附上

不用绑卡:这一页每条片子不登录就能看,免费注册再跑一条你自己的——4 秒、768P、带声音、无水印,可以下载,也可以拿去商用。

四种把角色按住的做法,出自 MiniMax 自己公开的示例。每张卡片都能展开完整提示词。

同一角色 AI 视频:一对情侣在厨房水槽边互相甩洗洁精泡沫,女方的脸取自一张静帧,节奏取自另一段参考片

脸来自静帧,表演来自片段

提示词进去,角色出来

左边是提示词,右边是它交回来的东西。

脸来自静帧,表演来自片段16:9 · 15 秒 · 1 张参考图 + 1 段参考片

两个文件,两份活。静帧说的是这是谁;片段说的是这个人怎么动、多快、什么节奏。谁也不替谁干活——而这条提示词在描述任何一个动作之前,先点名了哪个文件回答哪个问题。

The character's actions, expressions, and performance rhythm in Image 1 strictly reference input Video 1. A boy stands at the sink on the right side of the frame and hands a washed plate to the girl on the left side of the frame, then suddenly turns and flicks dish soap foam with his right hand towards the girl at the left edge of the frame. The girl, startled, immediately counterattacks, and the two begin happily splashing foam at each other and dodging, accompanied by loud laughter.

同一角色 AI 视频:一对情侣在厨房水槽边互相甩洗洁精泡沫,女方的脸取自一张静帧,节奏取自另一段参考片
一个角色,按住十五秒16:9 · 15 秒 · 2 张参考图

读第一句:把图 2 当作固定的角色参考,然后四个特征一个一个点名——半束的黑发、银质镂空发冠、长袍、配色。这份清单就是全部诀窍。你没点名的特征,就是模型可以自由重画的特征。

Use Image 2 as a fixed character reference, maintaining consistency of black half-tied long hair, silver hollow hair crown, dark blue hair ribbon, light layered Hanfu, semi-transparent blue outer robe, dark blue waist seal, silver floral buckle ornament, and long tassels. Use Image 1 as a reference for shot storyboarding and rhythm. The visuals are high-quality 4K 16:9 Guofeng 3D, with a film-grade xianxia texture,热血、庄严、宿命感强. The shots sequentially express the content in the storyboard, ensuring natural camera movement and transitions between each shot, it cannot be like a ppt. Character face reveals can only be close-ups or extreme close-ups, long shots can only be back views, side-back views, or environmental empty shots, no front-facing long shots.

同一角色 AI 视频:白衣银冠的仙侠女主穿过雪景段落,服装在每个镜头之间都没变
两位主角,一支预告9:16 · 15 秒 · 2 张参考图

这是一组演员,不是一个角色。提示词在写下第一拍之前,先把两位主角各自钉在自己的参考图上——因为两个人的戏就是两份会各自漂走的身份,而漂走的那个,总是你没钉住的那个。

Generate a 15-second, 9:16 vertical overseas real-person vampire romance short drama teaser clip. The appearance of the male and female leads references Image 1, and the scene references Image 2. Maintain the identity consistency of the male and female leads, real-person texture, and high-quality short drama texture. Overall story: The innocent human female lead mistakenly enters the forbidden area of an ancient castle and accidentally awakens the sleeping vampire noble male lead. The male lead discovers that she carries a certain aura related to an ancient war, thus developing a strong desire for control and dangerous interest in her. The female lead is afraid of him but does not completely submit, resisting his oppression. Overall style: Overseas ReelShort / DramaBox vampire romance short drama teaser feel. Dark romance, dangerous attraction, sense of fate, strong sense of control, gloomy oppression, highlight reversal. The visuals are high-end, restrained, and compact, like the hook of a hit short drama's first 15 seconds. No blood, no cheap horror, no Halloween feel, no modern street feel. Aspect ratio: 9:16 vertical composition, suitable for TikTok / ReelShort / DramaBox. Characters are mainly medium close-ups, close-ups, and extreme close-ups; the vertical screen should highlight faces, eyes, sense of oppression, and relationship tension.

同一角色 AI 视频:竖屏吸血鬼爱情预告在门口、走廊和双人近景之间,把同样的两位主角按住
换一批演员,同一套编排16:9 · 6 秒 · 1 段参考片

这里被按住的不是一张脸,是一套动作。三个穿西装的男人变成三只水豚,九个动作的自由体操套路每一拍都熬过了这次替换,因为扛着节奏的是片段,不是句子。

Reference Video 1 for action imitation. Fixed wide-angle shot, replace the three men in suits in the original video with three highly realistic capybaras. The capybaras must strictly follow the original video's motion trajectory: quickly lie down on the floor in sequence, then the leftmost capybara jumps to the middle position, the middle capybara rolls to the far left, then the middle capybara rolls to the far right, the rightmost capybara jumps to the middle, and finally the middle capybara jumps onto the backs of the other two, stacking into a pyramid shape. Maintain the original fixed camera position. Ensure the capybaras' fur texture and lighting integrate with the environment.

同一角色 AI 视频:三只穿西装的水豚做出一套复杂的自由体操动作,完全照着参考片里三个男人的动作走

它是什么,不是什么

这里没有任何东西记得你的角色这既是全部问题,也是全部方法。

这一段放在最前面,因为它决定你该不该留在这一页。每一个卖「角色一致性」的产品,卖给你的都是一份存起来的形象——Higgsfield 训练 Soul ID,Vidu 保留一组多图参考,Runway 锁住一个会话。存起来的是文件,而生成的那一刻发生的事,就是把这个文件挂到你的请求上。
所以问题不是「它记不记得」,而是它一次能收几个文件,以及你为「把它们存在某处」付了多少钱。

实测数据对谁都不客气,做预算之前值得先知道。在 Face Consistency Benchmark 上,单条文生视频片子内部的人脸漂移,比同一指标在真实素材上的结果远 2.1 到 5.7 倍:真实视频的 ArcFace 余弦距离是 0.0843,被测最好的模型是 0.1734,最差的是 0.4843。跨两条不同片子只会更难:ContextAnyone 对比里那些带参考条件的方法,视频之间的 ArcFace 相似度只有 0.54 到 0.59。
一张参考静帧是现存最大的那根杠杆,但它不是一把锁。它给你买到的,是一张在大多数出片里都会被观众读成同一个人的脸,而价格只是一次生成。

存一份角色形象,每月
$15–$129

存一份角色形象,每月

别处按时长算,每次尝试
$0.45–$2.00

别处按时长算,每次尝试

一次请求里的图、片、音频
9 · 3 · 3

一次请求里的图、片、音频

这里的 8 秒镜头,带声音
~$1.52

这里的 8 秒镜头,带声音

  • 第一个镜头之前不用训练任何形象
  • 不用为一个角色库一直交租
  • 不用另买一道对口型
  • 任何套餐都没有水印,不用解释

你要喂给它什么

四种说清「这是谁」的方式

只有一件事要紧:模型会把每个像素重画一遍,脸也不例外。它从不会把你的参考图贴进去。所以下面每个文件的活,是给这次重画上约束,不是提供成品素材。

  • 角色的静帧

    最多九张。一张干净的正面胜过三张糟糕的角度——实测里,参考图不是正面时,身份得分会掉一半以上。服装和道具各自单独发一张。

    最强的信号 · 最多 9 张图
  • 他已经出现过的片段

    最多三段。视频扛得住静帧扛不住的东西:步态、节奏、停顿的方式、一条运镜轨迹。这一页四个示例里有两个,表演就是从片段里取的。

    动作与节奏 · 最多 3 段片子
  • 他的声音

    最多三个音频文件——身份是声音,不比脸次要。H3 会参考音色,用同一把嗓子把你的新台词说出来,而且和画面在同一次里产出。音频必须跟着一张图或一段片子一起上传。

    参考音色,不是克隆 · 最多 3 个音频
  • 只有一段描述

    它在一个镜头里管用,在两个镜头之间就失效。写一次,生成出这个角色,然后留住你喜欢的那一帧,把它当作后面所有镜头的参考图。

    只够一个镜头 · 文生视频

四种走的是同一个模型、同一个价——768P 每秒 8 积分,2K 每秒 13,另加每条 5 积分。参考文件不额外收费。每一条上限和费率,都标了最后改动日期

从头到尾

四步把一个角色按住

顺序在这一页比在本站任何一页都重要,因为第一个镜头没定下来的演员,到第六个镜头就救不回来了。

  1. 白衣仙侠角色的一帧,这一帧成了参考静帧

    先定角,再写字

    挑出要成为这个角色的那几帧,像选角一样挑:一张干净正面、一张四分之三侧、服装、道具。光是换成非正面的输入,实测身份得分就掉一半以上——所以正面那张不是偏好,是承重的那个文件。

    最多 9 张图一张干净的正面
  2. 一个厨房双人镜头,脸来自静帧,节奏来自片段

    在句子里给每个文件派活

    H3 是用语言模型读提示词的,所以你可以告诉它哪个文件回答哪个问题。图 1 是角色;视频 1 是动作与节奏是一句管用的话。附上四个文件然后描述一场戏,不是。

    点名文件点名它的活
  3. 竖屏预告里的两位主角,跨过一刀之后依然被按住

    男女主角的外形严格follow参考图…… 他们的声音follow参考音频的音色。

    画面声音

    把这组演员带进下一个镜头

    两次请求之间什么都不会被记住。第二个镜头要带上和第一个一样的参考文件,再加上——这一步是大家会漏掉的——你从第一个镜头里留下来的一帧。上一个镜头的成片,就是下一个镜头最好的参考图。

    每次都重新附上留一帧下来
  4. 一位手绘男主角的近景,成片的一帧
    音轨 · 32 kHzSHOT-01.MP4

    768P 试,2K 定稿

    768P 一秒 8 积分,2K 一秒 13;而把一条跑完的 768P 再升到 2K,花的钱和一开始就用 2K 生成完全一样——所以为了抓住一张脸而跑掉的那六次,更便宜。生成失败自动退款。

    768P · 每秒 8 积分2K · 每秒 13 积分

四步,不用安装,不用绑卡。打开输入框

没人会告诉你的那件事

它漂在镜头之间,不是镜头内部。这是你要付的代价。

每一个卖角色一致性的页面都只给你看一条片子,而在一条片子内部,这个问题基本已经解决了。你真正要做的活是六条能剪在一起的片子,那是另一个指标——下面这些数字,量的是片子之间,不是片子内部。

  1. 01镜头之间那个数字才是真的

    带参考条件的方法,在同一个人的两条视频之间只拿到 0.54–0.59 的 ArcFace 相似度。一条片子内部会更高。做预算要按「那一刀」算,不是按「那一条」算。

    片子之间 0.54–0.59

  2. 02一张正面顶三张侧角

    参考图不是正面时,已公开的最强基线模型身份得分会掉超过 50%。如果你手上有一张好的角色正面帧,那就是要发的那张——而且每次都要发。

    非正面输入,掉幅 >50%

  3. 03上限是 9 图、3 片、3 音频

    一次请求共十二个文件,而且音频必须跟着一张图或一段视频,不能单独上传。这个上限才是值得拿去比的数字:大多数转卖这个模型的站点,根本不公开自己的。

    12 个文件,一次请求

  4. 04把不能变的东西点名

    那些真的按住了的公开示例,都是一个一个列特征——半束的头发、银发冠、外套的颜色。你没点名的特征,就是这次重画可以自由改写的特征,而它通常在第四个镜头就动手了。

    特征,逐条列出

  5. 05一场戏是一个镜头一次请求

    H3 出的是一段 4–15 秒的连续镜头。六个镜头的一场戏是六次请求,每次约 $1.52,再加上你剪辑软件里的一遍——整场戏大约 $9,这才是拿去和「按形象收的月费」比的那个数字。

    6 个镜头 ≈ $9

来源,供你自己核对:片内漂移的数字来自 Face Consistency Benchmark 的 ArcFace 那一列(真实视频 0.0843,被测最好的模型 0.1734,最差 0.4843——越低越好);跨片数字和非正面输入的掉幅来自 ContextAnyoneFaithfulFaces。这几篇都没有测过 MiniMax H3,我们自己也没跑过这套 benchmark:它们出现在这里,是为了说明这件事的难度量级,不是为了给这个模型排名。

为什么用它,而不是角色库

角色是一把嗓子,和一张脸一样重要

问问任何一个剪竖屏短剧的人。被扔掉的出片里有一半,是因为脸按住了、语气没按住——而在大多数工具上,声音是第二件商品:单独买,手动对。

  • 一次请求,一次生成

    声音跟着脸一起回来

    32 kHz 立体声和画面一起产出,而音频本身可以是你的参考文件之一——所以你附上去的那个音色,就是说出新台词的那个音色。没有对口型这一步,也不用另订一份配音服务。

  • 一次十二个文件

    整组演员塞得进一次请求

    九张图、三段片、三个音频,一共十二个。一场带服装和一张场景图的双人戏,放进去还绰绰有余——上面那支吸血鬼预告能同时按住两个人,就是因为这个。

  • 什么都不存

    没有要训练的形象,也不用为它交租

    这里没有 Soul ID,没有角色槽位,也没有按形象收的费用——文件在你自己的硬盘上,跟着请求一起上去。如果你要管理一整个角色阵容,这更差;如果你只有一个角色和六个镜头,这更好。

  • 一个价,六种画幅

    竖版和横版一个价

    21:9、16:9、4:3、1:1、3:4 和 9:16 都按同一套秒价计费,因为上游只数秒数,不看形状。竖屏短剧就是竖的,不会因此更贵。

你要放弃什么

一个保证。这是整个品类都得认的诚实边界:参考图能让这张脸在大多数出片里被读成同一个人,而跨镜头的公开数字停在 0.55 附近,不是 1 附近。如果你要交的东西需要一张分毫不差的脸——某位有名有姓的演员、品牌代言人、受法律保护的肖像——那就把人请来拍。他周围的镜头,可以在这里生成。

会反复出现的活

四种能在十五秒里成立的角色任务

四种不同的活,四条真的这么做出来的片子,每个按钮背后都是把它做出来的提示词。四个都需要你自己的文件——片上的角标写着是哪一种,按钮会打开对应的那扇门。

  • 同一角色 AI 视频:孩子们跑过夏天的田野,其中一个被换成金毛寻回犬,一件外套换了颜色,其他人都没动
    16:9 · 6 秒 · 2 张参考图 + 1 段参考片

    换掉其中一个,其他人不动

    一句话里两处修改:后排那个小孩换成图 1 里的狗,最左边那件外套换颜色。画面里没有提到别人,也没有别人发生变化。这就是你交给剪辑师的那张便条的写法,也是 H3 读得懂的写法。

  • 同一角色 AI 视频:一个穿同款西装的身影被加到双人镜头左侧,和其他人步调一致
    16:9 · 6 秒 · 1 段参考片

    加一个本来就该在场的人

    一行字,新来的人就继承了制服、步态和光线。模型不是把一张抠图合进去——它是把整个镜头连同多出来的这个人一起重画,所以影子才落得对,也因此原来的像素拿不回来

  • 同一角色 AI 视频:乙女游戏男主穿着皮夹克穿过夜色城市 PV,每一刀之间设定都没变
    16:9 · 15 秒 · 2 张参考图

    手绘角色,守住设定

    漂移在插画上最藏不住,因为一张画出来的脸没有摄影的宽容度可躲:眼距要么对得上设定稿,要么对不上。图 2 是身份的严格参考,提示词的其余部分只管运镜和氛围。

  • 同一角色 AI 视频:小饭馆里的一场竖屏短剧争吵,同样两位演员从头按到尾
    9:16 · 15 秒 · 2 张参考图

    演员固定的竖屏场景

    竖屏短剧就是这一页存在的理由:几十个镜头、同样两张脸、竖着拍。十五秒是一个镜头——你要带进下一次请求的是这组演员,而剪辑发生在你的软件里,不在这里

四条都是 MiniMax 自己公开的示例,按 CC BY 4.0 收集而来——所以每个按钮都能把提示词照它当初跑的样子原样载入。

它到底要花多少钱

一个角色、六个镜头的一场戏是 414 积分大约 $9。

一条片子是固定 5 积分的提示词理解,再加 768P 每秒 8 积分或 2K 每秒 13 积分。参考文件免费——附九张图和一张都不附是一个价。一积分等于 MiniMax 自己公开价目表上的一美分,所以整件事都能拿去和一个本站管不着的页面对账。生成失败自动退款,这一条在这里比在别处更要紧:按住一张脸,本来就是要重试的活。

角色镜头按时长要多少钱

一个 4 秒镜头,768P
37 积分
一个 8 秒镜头,768P
69 积分
一个 15 秒镜头,768P
125 积分
六个 8 秒镜头,768P
414 积分
一个 8 秒镜头,2K
109 积分
六个 8 秒镜头,2K
654 积分

完整价格 · 每一条上限与费率,都带日期 · 2K 一秒到底多少钱

两种付法每月积分一样多

  • 免费不用绑卡

    一条真的 MiniMax H3,带声音。超出 4 秒 · 768P 的部分按积分走。

    $0永久

    全程不需要信用卡

    免费开始

    只做机器人校验,不要邮箱

    1 条 MiniMax H3

    MiniMax H3 · 4 秒 · 768P · 16:9 · 带声音
    连签 7 天 — 37 积分,正好再来一条

    $9.9 起的任意积分包都能解锁 MiniMax H3,所有模式,768P 与 2K

    • MiniMax H3 原生 2K仅付费
    • 声音与画面一起生成仅付费
    • 一条,不用绑卡
    • 同时跑 1 个任务
    • 失败的片子不花钱
    • 生成内容私有
    • 任意积分包都能解锁 MiniMax H3 的全部模式

    免费档是另一个引擎。看套餐

    速度与排队

    队列
    免费通道
    同时任务数
    1
    批量
    1
    历史保留
    24 小时 · 登录后 7 天
    支持
    社区
  • Lite省 30%

    解锁 MiniMax H3 原生 2K。最小的付费档,大多数人选的是 Pro。

    $16.9/mo$24.9

    按年扣 $202.8 · 一年省 $96

    7 天退款 · 随时取消

    每月 750 积分 · 约 20 条

    4 秒 · 768P · 文生视频

    或 4 秒 2K 约 13 条

    月付年付,每月积分一样多

    • MiniMax H3 原生 2K:音画同生
    • 对白、音效与配乐在同一个文件里
    • 最长 15 秒15 秒
    • 每月约 20 条 4 秒 768P 文生视频
    • 失败的片子不花钱
    • 积分未使用可 7 天退款
    • 同时跑 1 个任务
    • 同一条提示词可批量出 2 个版本

    所有套餐均可商用:具体覆盖什么

    速度与排队

    队列
    标准
    同时任务数
    1
    批量
    2
    历史保留
    7 天
    支持
    邮件 · 48 小时
  • 多数人推荐
    Pro省 30%

    比 Lite 多 $32。每月约 47 条,同样的 MiniMax H3,队列更快。

    $39.9/mo$56.9

    按年扣 $478.8 · 一年省 $204

    7 天退款 · 随时取消

    每月 1,775 积分 · 约 47 条

    4 秒 · 768P · 文生视频

    或 4 秒 2K 约 31 条

    月付年付,每月积分一样多

    • 包含 Lite 的全部
    • 每月约 47 条 4 秒 768P 文生视频
    • 同时跑 3 个任务
    • 视频反推提示词
    • 同一条提示词可批量出 4 个版本
    • 历史保留 7 天
    • 积分未使用可 7 天退款

    所有套餐均可商用:具体覆盖什么

    速度与排队

    队列
    快速
    同时任务数
    3
    批量
    4
    历史保留
    7 天
    支持
    邮件 · 12 小时
  • Studio省 30%

    一整个月的产量,排队最优先,还有 4 小时内回你的真人。

    $99.9/mo$142.9

    按年扣 $1,198.8 · 一年省 $516

    7 天退款 · 随时取消

    每月 4,425 积分 · 约 119 条

    4 秒 · 768P · 文生视频

    或 4 秒 2K 约 77 条

    月付年付,每月积分一样多

    • 包含 Pro 的全部
    • 每月约 119 条 4 秒 768P 文生视频
    • 同时跑 8 个任务
    • 同一条提示词可批量出 4 个版本
    • 历史保留 7 天
    • 优先支持,4 小时内响应
    • 我们能给到的最低积分消耗
    • 积分未使用可 7 天退款

    所有套餐均可商用:具体覆盖什么

    速度与排队

    队列
    优先,排在最前面
    同时任务数
    8
    批量
    4
    历史保留
    7 天
    支持
    优先 · 4 小时

这东西真能拿去用吗

能商用——而肖像这件事归你负责

这是本站唯一一页,真正要紧的权利不在我们这边。上传一张脸和上传一个 logo 不是一回事,所以在你花钱之前,先把立场说清楚。

  • 商业使用免费那条也一样。任何套餐都没有水印,没有按条抽成,也不用另买授权。MiniMax 不主张你生成内容的任何权利,本站也不额外加。
  • 不属于你的那张脸这一条才是这里的重点。这一页的任何东西都不会给你别人的肖像权,而一个真实存在的人的脸,不会因为你手上有张照片就变成你的。像拍片一样,把授权拿到手。
  • 你自己的演员一位已经同意的人的参考静帧,仍然是你的。上传只用于跑你这次请求;回来的东西是你的,可以对外发布,而你对实拍素材做的那套合规检查,同样适用。
  • 会被拒绝的内容血腥暴力和色情内容会在入口就被拒绝,一秒钟都不会计费;把一个生成的人伪装成真实公众人物的内容也一样。这道检查同时看提示词和你附上去的文件。

完整的负责任使用说明

在你花钱之前

同一角色 AI 视频常见问题

把一个角色投进一场戏之前,大家会问的八个问题,答案都带着背后的数字。

这个同一角色视频工具免费吗?

第一条是免费的,而且跑的就是真模型——4 秒、768P、带声音、无水印、不用绑卡,还永不过期。这一页所有内容不登录都能看。之后 768P 的 8 秒镜头 69 积分,15 秒 125;积分从 $9.9 起,六个镜头的一场戏大约 $9。生成失败不收你钱。

角色在每个镜头里真的会长一样吗?

被读成同一个人,会;大多数出片都能做到。帧级一模一样,不会——这个品类里没有工具做得到。公开实测把带参考条件的跨片身份相似度放在 0.54–0.59 之间,而真实素材的基线要紧得多。按六条留四条来规划,并且每次请求都把同一批参考文件重新附上。

一次能附多少个参考文件?

一次请求最多 9 张图、3 段视频、3 个音频,共 12 个文件。音频必须跟着一张图或一段片子,不能单独上传。附参考文件不额外收费——你付的是渲染的秒数。

照片还是视频片段,哪个更能按住角色?

它们按住的东西不一样。静帧是脸和服装最强的信号;片段扛的是步态、节奏和运镜。两个都用,并在提示词里说清哪个是哪个。如果只能给一个文件,那就给一张干净的正面静帧:非正面输入下,实测身份得分会掉一半以上。

角色能保持同一把嗓子吗?

能——把音频当参考附上,H3 就会用那个音色说出你的新台词,而且和画面在同一次里产出,不是事后配的。它是音色参考,不是一份能存起来的克隆声音,而且它需要旁边有一张图或一段片子。

这和 Soul ID 或者角色库有什么不同?

那些是替你存一份形象,再按阵容收订阅费——比如 Higgsfield 是每月 $15 到 $129。这里什么都不存:你的文件跟着每次请求上去,你付的是秒数。如果你在管二十个角色,这更差;如果你只有一个角色、六个镜头要做,这更好。

能一次做完一整场戏吗?

不能。H3 出的是一段 4 到 15 个整秒的连续镜头,24 帧每秒,所以一场戏是一个镜头一次请求,剪辑在你的软件里做。时长会落在 17n+5 的帧网格上,192 帧——正好 8.000 秒——是这个区间里唯一的整秒,镜头要跟着音乐剪的话就用它。

能拿别人的脸当参考吗?

只有在你有权这么做的时候可以。这里的一切都不会给你某个人的肖像权,而生成真实公众人物会在入口被拒绝。如果是你自己的演员,像拍片一样把授权拿到手;之后回来的东西就是你的,可以商用,任意套餐都行,免费那条也算。

别再描述你的角色了,把他定下来。

一张静帧,一句说清每个文件干什么的话,大约九十秒后拿回一个镜头。第一条免费——不用绑卡,没有水印,而且可以拿去商用。

免费注册 · 送 1 条 MiniMax H3

MiniMax H3 AI Video Generator 编辑团队撰写与维护发布于 最后更新 工具版本 2026.09.4