模型发布
MiniMax H3 视频生成模型上线,支持多模态输入
MiniMax 在 HailuoAI 与 MiniMax API 平台上线 H3 视频生成模型,支持文本、图像、音频、视…
2026.08.01 · 周六约 2 分钟阅读
MiniMax 宣布其视频生成模型 H3 已在 HailuoAI 和 MiniMax API 双平台上架,支持文本、图像、音频和视频四种输入模态,定位为「一体化参考」的多模态视频生成方案。官方同时公布了按秒计费的阶梯定价,2K 分辨率视频起价为 0.081 美元/秒,即将上线的 768p 分辨率版本起价低至 0.047 美元/秒。
多模态输入与编辑能力
H3 的核心卖点是「All-in-One Reference」,即在同一接口中支持文本、图像、音频、视频四种输入作为参考素材,允许创作者将不同模态的内容组合进同一条生成管线。此外,模型提供精确编辑控制(Precise editing controls),用户可以依据具体指令对生成结果进行迭代和优化,而不是依赖纯随机抽样。
- 输入模态:文本、图像、音频、视频
- 编辑方式:按精确指令迭代修改
面向创意与商业场景
据官方介绍,H3 面向从电影、广告、游戏到品牌和电商等多种创意与商业场景。与此前常见的实验性视频生成工具不同,H3 在 API 层面即开放了商用所需的分辨率选项与计费结构,便于直接接入到现有产品链路中。
- 适用场景:电影、广告、游戏、品牌内容、电商素材
- 接入方式:HailuoAI 平台与 MiniMax API
价格与可用版本
H3 的定价以「美元/秒」为基本单位,明显低于业内部分同类服务的报价,对批量生成和长视频工作流较为友好。
- 2K 视频:0.081 美元/秒(已上线)
- 768p 视频:0.047 美元/秒(即将上线)
目前消息来自 TestingCatalog 在 X 平台转发的官方要点,MiniMax 官方博客尚未给出详细的技术报告或模型架构说明,更多关于生成质量、时长上限、并发配额等关键参数仍待进一步披露。
