MiniMax H3 · MiniMax 出品

MiniMax H3 视频生成器

MiniMax H3:原生 2K 输出,每一条片段都自带声音,参考输入可同时接受图片、视频和音频。

登录后即可生成,你写的提示词会保留。

一个模型,各种画风

六条都由 MiniMax H3 以 2K 直接生成——原片直出,没有调色环节。

沙漠里,男人在燃烧的汽车旁读报
沙漠里,男人在燃烧的汽车旁读报
古装特写,烛光扫过昏暗厅堂中的脸
古装特写,烛光扫过昏暗厅堂中的脸
插画风的发光蜗牛飘过一片罂粟花田
插画风的发光蜗牛飘过一片罂粟花田
微距:同一个发光角色停在摊开的手掌上
微距:同一个发光角色停在摊开的手掌上
美妆特写,硬光棚拍下的护目镜式墨镜
美妆特写,硬光棚拍下的护目镜式墨镜
两位模特身着雕塑感黑白服装,站在白色影棚背景前
两位模特身着雕塑感黑白服装,站在白色影棚背景前

原生 2K

按 2K 生成而不是事后放大——差别最先体现在人脸和细微质感上。

声音恒随

每条片段默认带声音生成。没有静音模式,也没有另一档静音价。

首尾帧控制

钉住镜头两端,MiniMax H3 补出中间的运动。做产品和片头很稳。

混合参考

最多 9 张图 + 3 段视频 + 3 段音频,一起作为主体与风格的锚点。

概览

MiniMax H3 是什么?

MiniMax H3 是 MiniMax 的第三代视频模型,在 API 上的名字是 MiniMax-H3。MiniMax 一直以运动的物理可信度立身——身体有重量、布料会落定、水的行为像水——而 MiniMax H3 把这份口碑接到了原生 2K 输出上。同档位的模型大多输出 720p 或 1080p,剩下的交给你去放大;MiniMax H3 直接按 2K 生成,这一点在人脸上体现得最明显,因为放大通常会把皮肤变成塑料。

声音在 MiniMax H3 里不是一个选项,而是一种属性。每一条片段回来时都带着与画面一同生成的声音——没有关掉它的开关,也没有「静音版」的另一档价格。参考这一侧,你可以给最多 9 张图、3 段视频、3 段音频;或者改为钉住首帧和尾帧,让模型补出中间的运动。这两种模式互斥:要么锁帧,要么挂多模态参考,同一次请求里不能兼得。时长 4 到 15 秒按整秒取,画幅覆盖 21:9、16:9、4:3、1:1、3:4 和 9:16。

MiniMax H3 真正站得住的地方,是写实人物镜头。如果一场戏是靠演员的脸撑起来的——一个反应、一句台词、一瞬间的迟疑——2K 的细节加上 MiniMax 的运动建模,就是它值得比便宜模型多花钱的理由。本页这个 MiniMax H3 视频生成器直接驱动模型,一次点击出一条片段;完整工作流则在背后调用这类引擎,替你规划并串起一整个带旁白的故事。

大家用 MiniMax H3 做什么

这三类镜头,图的就是 2K 细节和站得住的运动。

MiniMax H3 特写:烛光下的女性面部,正处在情绪反应中
应用场景·01 / 03

靠表演撑场的人物特写

特写人脸是最难造假的东西,也是 720p 放大后第一个露馅的地方。MiniMax H3 从一开始就按 2K 生成,眼神保持锐利,皮肤留得住质感。再加上声音与画面一起产出,一句台词回来时就已经对上了口型。

MiniMax H3 参考生成:一只发光的插画风蜗牛停在真实的厨房水槽里
应用场景·02 / 03

把设计好的角色放进真实场景

把你已经设计好的角色参考图交给 MiniMax H3,它会把这个角色放进实拍质感的场景,同时保住设计的辨识度——一样的比例、一样的配色、一样的性格。参考图额度有 9 张,你可以覆盖多个角度,这正是角色转身时不会「自己重画一遍」的原因。

MiniMax H3 竖屏时尚短片:两位模特在白色摄影棚背景前的造型
应用场景·03 / 03

2K 竖屏时尚与品牌短片

时尚这一类最不留情面:布料必须垂坠正确,一件衣服的剪裁要经得住动作。而这恰好是 MiniMax 系列一贯被认可的物理可信度。9:16 画幅下的 2K 成片放到手机上也扛得住,不会出现那种一眼看穿是放大的发虚感。

工作流

怎么用

从想法到一条可分享的片段,只需三步 —— 不用剪辑器、不装插件。

01 · 写

写一条 prompt

用大白话描述镜头:主体、动作、光线、运镜,写得越细越好 —— 新一代模型对细节更敏感。

02 · 选

选模式 + 时长

在「文本」「图生视频」「首尾帧」之间切换,再挑分辨率和时长 —— 价格在按钮上实时更新。

03 · 生成

生成、下载、迭代

点 Generate,几分钟后片段直接落到作品库里。可以存下来,也可以改改 prompt 再跑一次,或者把同一个创意拿进 Story Into Video 工作流,做成一支带完整旁白的故事视频。

Story Into Video

在 Story Into Video 里使用 MiniMax H3 视频生成器

本页每次点击生成一条 MiniMax H3 片段——4 到 15 秒、2K、含声音。做一个主镜头,或者在投入更长的片子之前先试试 MiniMax H3 能不能拿捏住你的角色,通常就够用了。

但成片需要的不止一个镜头。你可以先在这里用单条 MiniMax H3 提示词把风格试出来,再把想法带进完整工作流:描述故事、选定画风,管线会写好分镜、让角色在场景之间保持一致,并逐镜生成带旁白和字幕的成片。生成是异步的,完整故事要几分钟,提交后去忙别的、回来再看。

MiniMax H3 规格速览

计费方式
按秒计费——实时单价见生成按钮
时长
4 – 15 秒(按整秒)
画质
2K
画幅比例
21:9 · 16:9 · 4:3 · 1:1 · 3:4 · 9:16
参考输入
最多 9 张图 + 3 段视频 + 3 段音频,或者首尾帧

计费统一走 Story Into Video 积分——实时金额显示在生成按钮上。

适用人群

适合谁用

真正在做内容的创作者,不止是玩玩。

短视频创作者

TikTok、Reels、YouTube Shorts —— 把每天的脚本变成一堆 5–15 秒的电影感片段,不用真人拍摄。

营销 / 品牌团队

产品广告、落地页配图、邮件 b-roll —— 锁住品牌风格,一次拉满整个 campaign 的素材。

编剧、教师、创意公司

在拍实景之前,先把剧本做成一支带完整旁白的视频 —— 角色、配音、字幕都在 Story Into Video 里一并搞定。

MiniMax H3 常见问题

MiniMax H3 和海螺 3(Hailuo 3)是同一个吗?+
是同一个模型的两个名字。MiniMax-H3 是它在 MiniMax API 上的模型 id,Hailuo 3(有时写作 Hailuo 03、海螺 3)是面向消费者的品牌名。本页和生成器统一使用 MiniMax H3,所以你如果是搜另一个名字过来的,没有走错地方。
MiniMax H3 的声音能关掉吗?+
不能,而且这是设计如此、不是漏做。MiniMax H3 的声音与画面一起生成,接口层面就没有开关,所以既没有静音版本,也没有更便宜的静音价。确实需要无声素材的话,拿到成片后自行静音或抽掉音轨——费用仍按已生成的那条镜头计。
MiniMax H3 和 Seedance 2.5 怎么选?+
本质是「分辨率 + 真人写实」对「长度 + 参考深度」。MiniMax H3 按 2K 生成,特写和物理可信的运动更强,但止步 15 秒、参考图 9 张;Seedance 2.5 单镜能到 30 秒、可挂 50 个参考,但画质封顶 720p。拍脸、拍布料,选 MiniMax H3;要长镜头不间断,选 Seedance 2.5。
首尾帧和参考图能在同一条镜头里一起用吗?+
不能——MiniMax 把这两者当成互斥的两种模式,混着传会被直接拒掉。要么钉住首帧和尾帧、让 MiniMax H3 生成中间的运动,要么挂参考图/视频/音频去引导主体与风格。动手之前先想清楚这条镜头到底需要哪一种。
MiniMax H3 的提示词能写多长?+
上限约 7,000 字符,远超绝大多数镜头的需要。MiniMax H3 对运镜、光线和表演的情绪起伏这类描述反应很好,所以与其只罗列画面里有什么,不如多花几句把这些交代清楚。
相关模型
看看其他 AI 故事工具