现已上线

生成电影质感视频,声音一并生成。

输入一段文字、一张图片或一个参考片段,直接产出画面与立体声同步的成片。最长 15 秒、2K 画质,约 3 秒出片。

添加参考素材图片、视频或音频
~3s
生成耗时
2K
最高分辨率
15s
视频时长
33B
模型参数量

用 MiniMax H3 做出来的作品

点击任意视频,立刻按你的想法重做一版。

一个模型, 该有的全都有。

原生立体声、11 种语言口型同步、6 种画幅比例,不需要再走一遍后期流程。

原生立体声音频

声音与画面在同一次生成中一起产出:对白、环境音、配乐全部对齐,无需任何后期处理。

约 3 秒出片

H3-Max 生成完整的 15 秒 2K 视频只需约 3 秒。不用排队等待,想到就能立刻改一版。

2K 画质,6 种比例

最高支持 2K 分辨率,横屏、竖屏、方形以及三种电影级画幅任选。所有格式,一个模型搞定。

11 种语言口型同步

角色说话时,口型会自动与音频对齐,覆盖 11 种语言,不需要手动 K 帧。

常见问题

MiniMax H3 是什么?
MiniMax H3 是一个开源的 330 亿参数稠密 Transformer 视频生成模型,单次生成即可输出最长 15 秒、带原生立体声音频的 2K 视频。
H3 会自动生成声音吗?
会。和大多数视频模型不同,H3 把对白、音效和环境音作为视频生成的一部分同步产出,而不是事后单独再做一步。
支持哪些画幅比例?
H3 支持 6 种比例:16:9(横屏)、9:16(竖屏)、1:1(方形)、4:3、3:4,以及 21:9(超宽电影画幅)。
生成速度有多快?
H3-Max 生成完整的 15 秒视频约需 3 秒。具体耗时会随分辨率和时长设置有所不同。
可以用自己的图片作为输入吗?
可以。H3 支持文生视频、图生视频和参考片段生视频三种模式,上传图片或提供参考片段即可引导生成结果。

现在就开始生成视频

无需注册即可试用。描述你的画面,点击生成,看它连声音一起活过来。