文生视频
用一个连贯的提示词描述主体、动作、镜头、光线和声音。
用提示词或源图片创建短 AI 视频。MiniMax H3 Max 支持文生视频和图生视频,可选 480P 或 768P、5–15 秒时长;公开基准显示,5 秒视频渲染可低于 3 秒。
* 该速度来自 5 秒 H3 Max 视频的公开基准;实际时间会因队列和设置而变化。
用提示词或源图片创建 5–15 秒 AI 视频,然后预览并下载完成的 MP4。
你可以在同一个提示词中同时描述画面、音频和对白。
生成的视频会显示在这里
MiniMax H3 Max 是 MiniMax H3 的后训练版本,面向快速、提示词主导的视频创作。它更强调提示词遵循和画面美感,因此主体、动作、镜头、光线、节奏与声音方向等细节,都能更清晰地参与最终镜头的表达。
速度是它在工作流中的实际差异。公开基准显示,5 秒 H3 Max 视频渲染可低于 3 秒。这使它适合快速创意迭代:先写一个明确镜头,查看运动和构图,再让下一版提示词更具体,而不是长时间等待每次渲染。
从文字构思完整场景时使用文生视频;当产品图、角色静帧、插画或关键画面需要锚定开场时,使用图生视频。还可以添加可选尾帧来引导镜头结束位置;当前工作台支持 480P 或 768P,以及 5–15 秒短片。
用一个连贯的提示词描述主体、动作、镜头、光线和声音。
快速草稿可选择 480P;需要更多画面细节时可选择 768P。
按整秒生成短片;公开基准显示,H3 Max 的 5 秒视频渲染可低于 3 秒。
文生视频支持 21:9、16:9、4:3、1:1、3:4 和 9:16 构图。
图生视频可使用源图片,以及可选的尾帧图片来引导过渡。
一次先规划一个明确镜头:将主体、动作、镜头运动、光线、节奏和声音连接成一条清晰指令。
让产品图、海报、界面或包装图配合受控镜头运动和简短声音提示动起来。
以角色静帧作为视觉锚点,再描述表情、动作、节奏和场景声音。
将推广概念变成 5–15 秒的竖屏、方形、宽屏或电影感社媒短片草稿。
播放两条完成的 H3 Max 样例:一条由文本生成,另一条由输入图片引导。
一条提示词同时描述主体、场景、镜头运动、氛围和声音方向。
源图片锚定开场画面,提示词再描述表情、对白和场景运动。
需要快速文生或图生工作流时选择 H3 Max;需要 2K 输出,或更多参考素材与编辑能力时选择 MiniMax H3。
| 维度 | MiniMax H3 Max | MiniMax H3 |
|---|---|---|
| 定位 | 后训练的 H3,强调提示词遵循、画面美感与吞吐 | 开放权重的通用多模态视频模型 |
| 分辨率 | 480P 或 768P | 2K,24 fps |
| 速度 | 公开基准显示,5 秒视频渲染可低于 3 秒 | 当 2K 或更完整的多模态工作流优先于速度时选择 H3 |
| 生成输入 | 文生视频与图生视频 | 文本、图像、视频和音频可进入同一上下文 |
| 端点范围 | 文生视频;图生视频支持可选尾帧 | 文生、图生、参考生成和自然语言编辑 |
| 适用场景 | 快速草稿、提示词主导的镜头和图片动画 | 2K 成片、多参考素材指引与已有视频编辑 |
选择来源,描述一个连贯镜头,然后在看到真实运动和节奏后继续生成并优化。
文生视频直接写提示词;图生视频则上传一张源图片。
说明画面中有什么、会发生什么变化、镜头如何运动,以及场景听起来是什么样。
选择时长和清晰度。查看 MP4 后,让下一版提示词或源图更具体。
解答 H3 Max 工作流、可选输出参数,以及提示词和源图片的使用方法。
它是 MiniMax H3 的后训练版本,用于文生视频和图生视频,并针对提示词遵循和画面美感进行了优化。
工作台提供 480P 或 768P、5–15 秒时长,以及从 21:9 到 9:16 的六种文生视频画幅。
可以。图生视频会将上传图片作为首帧;也可以加入可选尾帧图片来引导最后一帧。
先写可见主体和动作,再补充场景、镜头运动、光线、节奏和声音。一个连贯镜头更容易评估和迭代。
会。图生视频在提供源图片时会遵循该图片的输出画幅。
完成的 MP4 会保留在工作台和“我的作品”中,可供预览或下载。
写一条清晰的镜头提示词,必要时选择源图片,然后在工作台创建真实 H3 Max 视频。