由 fal 针对速度后训练的 MiniMax H3 Max
MiniMax H3 Max 不到 3 秒渲染一段 5 秒视频
MiniMax H3 Max 是 MiniMax H3 的提速版本,由 fal 后训练。在 fal 2026 年 9 月的基准测试中,它约 2.5 秒生成一段 5 秒 768P 视频,不到 18 秒生成一段 15 秒 1080P 视频,比 MiniMax 官方 H3 推理快约 15 倍;截至 2026 年 9 月,它在 Artificial Analysis 和 Design Arena 的图生视频榜单上排名第一。你可以从文本生成、为首尾帧添加动态、组合多模态参考素材或指挥关键帧相机运动,然后趁灵感尚新快速迭代 5–15 秒、480P、768P 或 1080P 的视频。
四种生成模式
让 MiniMax H3 Max 从创意、构图、参考素材或相机路径开始。极速生成让你能测试更多方向,每种模式则专注于控制不同的创作变量。
文生视频
描述主体、动作、环境、镜头表现、光线与氛围,文本生成视频几秒内就会返回完整场景,改写后的提示词可以立刻验证。
图生视频
用一张图片锁定精确首帧;当镜头需要抵达指定视觉终点时,还可以添加尾帧。
参考生成视频
组合最多 12 个图片、视频和音频文件,引导角色身份、风格、动作、节奏与氛围。
相机控制
保持参考场景冻结,通过有序关键帧控制相机时间、环绕角度、高度角和相对距离。
一套实用的快速视频创作流程
- 1根据最需要保持可预测的元素选择模式:创意、开场构图、参考身份或相机路径。
- 2描述一个清晰动作和镜头方向,再选择时长、分辨率、可用比例与提示词扩展质量,增强提示词遵循度。
- 3快速生成首个版本,检查连续性、运动、构图与光线,再每次只调整一条指令或一份参考素材。
用更少时间探索更多创作方向
- 帮助营销团队在紧凑制作周期内,把产品静态图快速变成精致展示与相机可控的营销方案。
- 让创作者与工作室快速赋予人像、插画、风景和分镜自然动态,同时保留开场构图。
- 让创意团队用多模态参考测试更多角色一致、风格统一、动作明确或由音频引导的方向,再确定最终方案。
把生成速度转化为可重复的创作流程
MiniMax H3 Max 的速度真正有价值之处,在于帮助你做出明确判断,而不是堆积随机版本。每次草稿先聚焦一个问题:主体动作是否正确、相机是否沿预期轨迹运动,或参考素材是否保留了所需的身份与氛围?快速出片让你逐一验证、保留有效部分,再继续解决下一个问题,同时不偏离最初的创作方向。
先验证动作,再提高分辨率
先用简短的 480P 草稿检查主要动作是否清晰,并能否在所选时长内完成。留意主体、背景、构图或转场是否出现意外变化。确认动作和节奏可信后,再沿用已经验证的方向生成 768P 或 1080P 版本,获得更精致的结果,避免把高分辨率生成用在尚未验证的想法上。
围绕可见变化编写提示词
按照观众看到镜头内容的顺序组织提示词:先明确主体及必须保持可辨识的细节,再描述一个主要动作、指定相机如何响应,最后补充光线、氛围、节奏和预期结尾。具体的视觉指令比一长串彼此无关的形容词更有助于准确遵循提示词,尤其是在多份参考素材已经提供风格与身份信息时。
分别描述主体动作与相机运动
进行常规文生视频或图生视频时,把主体做什么与相机如何观察分别写成两条清晰指令。如果场景需要完全静止,可切换到相机控制模式并建立有序轨迹。谨慎调整归一化时间、方位角、仰角和距离,便于评估并复现环绕、升高、拉远或靠近等镜头运动,而无需让模型自行创造场景动作。
每轮迭代只检查一个变量
每次获得结果后,先与原始需求对照,再开始修改。分别检查身份一致性、构图、动作、相机轨迹、光线、参考素材影响和结尾。保留已经有效的设置,在下一次快速生成中只调整最薄弱的变量。这种有序循环能让改进更容易辨认,也可避免有效的提示词、首尾帧组合或相机轨迹在大幅重写中丢失。
H3 还是 H3 Max:该用哪一个
两款模型共享 MiniMax H3 架构和相同的 5–15 秒时长范围,但侧重点不同。H3 Max 由 fal 针对生成速度、提示词遵循度和关键帧相机控制进行后训练;原版 MiniMax H3 保留 2K 输出和更大的多模态参考组合。按镜头需求选择,而不是按名字。
| 对比项 | MiniMax H3 | MiniMax H3 Max |
|---|---|---|
| 最适合 | 2K 交付与多模态参考创作 | 快速迭代与关键帧运镜 |
| 生成速度 | MiniMax 标准推理 | 5 秒 768P 视频约 2.5 秒,快约 15 倍 |
| 分辨率 | 768P、2K | 480P、768P、1080P |
| 时长 | 5–15 秒 | 5–15 秒 |
| 相机控制 | 通过提示词描述 | 最多 12 个有序关键帧:时间、方位角、仰角、距离 |
| 参考素材 | 最多 9 张图片、3 段视频和 3 段音频 | 最多 12 个文件,涵盖图片、视频和音频 |
速度数据来自 fal 于 2026 年 9 月 8 日对 H3 Max 接口的官方计时;实际等待时间还包括排队、提示词扩展和编码。
需要 2K 输出?打开 MiniMax H3MiniMax H3 Max 常见问题
MiniMax H3 Max 是什么?
MiniMax H3 Max 是一款生成速度极快的 AI 视频模型,支持文本、图片、多模态参考与关键帧相机控制,适合快速获得忠于提示词的结果并持续迭代。
可以选择哪些时长和分辨率?
MiniMax H3 Max 支持 5–15 秒整数时长,可生成 480P、768P 或 1080P 视频。
最多可以上传多少份参考素材?
参考模式最多接受 12 个图片、视频和音频文件。请在提示词中按素材类型和顺序指代每个文件。
相机控制如何工作?
最多添加 12 个有序关键帧,每个关键帧可设置归一化时间、水平方位角、垂直高度角和相对相机距离。