开源
MiniMax 视频模型 H3 获 vLLM-Omni 首日支持
MiniMax 宣布视频生成模型 H3 在 vLLM-Omni 中获得首日支持,并提供与 OpenAI 兼容的视频接口。
2026.08.03 · 周一约 2 分钟阅读
视频生成模型 H3 已获得 vLLM-Omni 的首日(Day 0)推理支持,并配套提供与 OpenAI API 兼容的视频端点。MiniMax 在其官方 X 账号上确认了这一集成进展,并感谢 vLLM 团队将 H3 纳入开源推理生态。
集成要点
根据官方公告,本次集成涵盖以下核心内容:
- 首日支持:H3 在 vLLM-Omni 上线时即获得原生适配,无需等待后续补丁;
- OpenAI 兼容视频端点:开发者可通过与 OpenAI 视频 API 兼容的接口调用 H3,便于迁移既有应用;
- 开放权重模型:H3 作为可下载权重的模型,加入 vLLM 维护的开源推理栈。
官方使用的标签为 #MiniMaxH3 与 #OpenWeights,表明该模型定位为开放权重的视频生成方案。
关于 H3 与 vLLM-Omni
H3 由 MiniMax 推出,主打视频生成能力。vLLM 是社区中主流的开源大模型推理引擎之一,而 vLLM-Omni 是其在多模态方向的扩展,目标是为视频、音频等多模态生成模型提供高吞吐、低延迟的推理能力。
将开放权重的视频模型接入 vLLM-Omni,意味着开发者可以直接调用成熟的推理栈,免去自行实现调度、批处理和显存管理等工程环节。
对开发者的意义
对于正在构建视频生成应用的团队而言,推理基础设施的门槛进一步降低:
- 与 OpenAI 兼容的工具链可直接复用,减少改写成本;
- 开源推理栈降低了部署与运维投入;
- 有助于推动开放权重视频模型在社区场景中的实际落地。
待补充信息
本次官方公告篇幅较短,尚未披露以下关键技术细节,建议读者关注后续更新:
- 模型参数规模与训练数据来源;
- 在 vLLM-Omni 中的具体性能指标(推理速度、显存占用、并发上限等);
- 是否提供量化版本或多种精度权重;
- 商用许可条款。
在缺少上述细节前,社区可在 vLLM 项目仓库中跟进 H3 适配的 PR 与文档进展。
