MiniMax H3 评测:规格、演示与局限
基于证据解读 MiniMax H3:涵盖已记录的规格、六个官方演示,以及制作前需要核实的局限。
MiniMax H3 是一套结合文本、图像、视频和音频的多模态 AI 视频工作流。本文审阅的文档记录了 5–15 秒视频、24 FPS、原生立体声音频、1440p 模式,以及混合参考输入。
本文有一条清晰边界:以下六段视频来自 MiniMax,而非 PixVerse 的测试运行。它们展示的是 MiniMax 选择演示的效果,无法说明你用自己的素材是否有相同的成功概率、你的账户当前可以使用什么功能,或需要多少成本。若要查看与 Seedance 2.0 使用相同提示词的对比,请参阅 MiniMax H3 与 Seedance 2.0 测试框架。
MiniMax H3 概览
| 项目 | MiniMax H3 手册记录 | 投入制作前需确认 |
|---|---|---|
| 输出 | 5–15 秒、24 FPS、原生立体声音频 | 你的账户中可用的设置与当前成本 |
| 分辨率和画幅 | 1440p 模式;从 21:9 到 9:16 的六种画幅 | 地区限制与导出政策 |
| 首尾帧模式 | 零、一或两张图片;提供图片时保留输入画幅 | 图片数量限制,以及重复生成时的一致性 |
| 一体化参考模式 | 最多 9 张图片、3 段视频和 3 段音频;合计 12 个文件 | 在真实创意简报中如何处理相互冲突的参考 |
| 提示词和上传 | 提示词最多 7,000 个字符,支持常见媒体格式 | 上传大小限制、速率限制和 API 行为 |
这些数字来自本文审阅的手册版本。将它们作为起点,并在给模型设定交付期限前,查看当前的 MiniMax Hub、Hailuo AI 体验中心或 MiniMax API 平台。
除演示集外还应测试什么
参考素材的指引
手册记录的一体化工作流可在同一次生成中接收文本、图像、视频和音频。当创意简报把身份、动作、镜头运动、剪辑节奏和声音分别放在不同素材中时,这一点尤其重要。让每个参考素材各司其职,再观察结果是否能将这些职责区分开来,而不是从一张图片中提取氛围后忽略其余内容。
对于构建这类参考包的团队,PixVerse Canvas 工作流可将已批准的静帧、动态片段和提示词版本集中在一处。
动作、人物与道具
MiniMax 将 H3 定位为能呈现更连贯动作和物理行为的模型。需要检查的并不花哨:手是否始终握住道具,镜头移动时夹克是否保持形状,以及两个人从彼此前方交错而过时房间是否维持不变。这些细节决定了一个漂亮的开场画面能否经受剪辑。
如果身份一致性是主要风险,请先使用一致的角色素材包,并在每次尝试中固定身份指令。我们的 一致 AI 视频角色指南说明了在改变动作或镜头方向前值得锁定的输入。
音频与局部编辑
手册还记录了原生音频、口型同步、音色迁移,以及对角色、物体、背景、视觉效果和对白的编辑。请分别测试这些任务。一段视频的环境声可能不错,却无法对准对白时序;物体替换看起来没问题,但手从其前方经过时就可能露出破绽。请像明确想要改变什么一样,清楚地说明哪些内容必须保持不变。
六个官方 MiniMax 演示
以下是 MiniMax 自己选择用来展示能力范围的示例,并非六项独立测试结果。
电影开场演员序列
开场字幕通过演员画面与图形面板推进。这里可观察剪辑节奏和标题清晰度;该视频无法说明同样的风格是否能在新的参考包中保持一致。
MiniMax 官方演示:电影开场与字幕序列方向。
手绘视觉特效
该视频将手绘效果叠加在实拍动作上。关键问题是这种处理是否感觉依附于场景,而非简单地贴在上面。它仍无法说明新的源视频在快速动作或手部遮挡时能否维持效果。
MiniMax 官方演示:实拍画面上的插画效果。
预告片混剪
这支预告片强调节奏与推广,而非完整成片。编辑可能会从这种素材中挑选几个可用节拍,再经过人工剪辑塑形。
MiniMax 官方演示:短视频预告与混剪方向。
产品效果广告
这是适合转化为更严格产品测试的演示类型:同时保持产品形状、主角和构图稳定。一条精致的广告镜头如果产品在特写之间发生变化,依然会失败。
MiniMax 官方演示:参考素材引导的产品广告方向。
产品拆解展示
这个组件展示试图解释产品,而不只是美化它。请检查功能展示的顺序是否清晰,以及效果是否阐明真实几何结构,而不是将其替换掉。
MiniMax 官方演示:技术产品叙事与组件展示。
竖版真人微短剧
这个竖版场景考验面部表演、正反打镜头的连续性和音频时序。它是使用两名人物与明确互动进行对照测试的良好模式。
MiniMax 官方演示:竖版叙事与角色表演方向。
将 H3 纳入制作流程之前
- 在你计划使用的渠道中确认确切模型名称、可用分辨率、积分成本、排队行为和水印政策。
- 在将模型投入更大型制作前,先测试一个包含手部、道具和移动镜头的高互动场景。
- 将源视频、声音、肖像、音乐、标志和商用权利写入项目简报,而不是事后才考虑。
- 保存好的和不好的生成结果。一条出众的视频不足以据此选择模型。
在 PixVerse 使用多模型工作流
不同创意简报会在不同环节出现问题。产品团队可能更在意标签和几何结构稳定性;社交团队可能更在意表演者、节奏和声音。PixVerse 让团队保留一份参考包,并尝试可用的生成工作流,而不必每次都重建简报。
若要查看更广泛的模型清单,请参阅最佳 AI 视频生成器。若要了解当前可用的详细 PixVerse 路径,请参阅 PixVerse V6 评测。
常见问题
什么是 MiniMax H3?
MiniMax H3 是一套结合文本、图像、视频和音频的多模态 AI 视频工作流。在将它用于制作之前,请在当前产品界面中确认可用设置、价格和访问路径。
六段视频是独立测试的吗?
不是。它们是 MiniMax 为展示不同创作方向而选择的官方演示,并非可重复结果、当前可用性或制作可靠性的证据。
团队应先测试 MiniMax H3 的什么?
从最可能损害你项目的失败点开始:产品几何结构、角色身份、手与道具的互动、镜头方向或音频时序。在做出制作决策前,请在两次或更多次尝试中保持源素材和提示词不变。
MiniMax H3 已在 PixVerse 上可用吗?
在围绕 MiniMax H3 规划项目之前,请在当前 PixVerse 模型选择器中确认其可用性。PixVerse 仍可用于以同一简报比较可用的 AI 视频工作流。