桃子桃子快讯
返回首页
开源

MiniMax 视频模型 H3 获 vLLM-Omni 首日支持

MiniMax 宣布视频生成模型 H3 在 vLLM-Omni 中获得首日支持,并提供与 OpenAI 兼容的视频接口。

2026.08.03 · 周一2 分钟阅读

视频生成模型 H3 已获得 vLLM-Omni 的首日(Day 0)推理支持,并配套提供与 OpenAI API 兼容的视频端点。MiniMax 在其官方 X 账号上确认了这一集成进展,并感谢 vLLM 团队将 H3 纳入开源推理生态。

集成要点

根据官方公告,本次集成涵盖以下核心内容:

  • 首日支持:H3 在 vLLM-Omni 上线时即获得原生适配,无需等待后续补丁;
  • OpenAI 兼容视频端点:开发者可通过与 OpenAI 视频 API 兼容的接口调用 H3,便于迁移既有应用;
  • 开放权重模型:H3 作为可下载权重的模型,加入 vLLM 维护的开源推理栈。

官方使用的标签为 #MiniMaxH3 与 #OpenWeights,表明该模型定位为开放权重的视频生成方案。

关于 H3 与 vLLM-Omni

H3 由 MiniMax 推出,主打视频生成能力。vLLM 是社区中主流的开源大模型推理引擎之一,而 vLLM-Omni 是其在多模态方向的扩展,目标是为视频、音频等多模态生成模型提供高吞吐、低延迟的推理能力。

将开放权重的视频模型接入 vLLM-Omni,意味着开发者可以直接调用成熟的推理栈,免去自行实现调度、批处理和显存管理等工程环节。

对开发者的意义

对于正在构建视频生成应用的团队而言,推理基础设施的门槛进一步降低:

  • 与 OpenAI 兼容的工具链可直接复用,减少改写成本;
  • 开源推理栈降低了部署与运维投入;
  • 有助于推动开放权重视频模型在社区场景中的实际落地。

待补充信息

本次官方公告篇幅较短,尚未披露以下关键技术细节,建议读者关注后续更新:

  • 模型参数规模与训练数据来源;
  • 在 vLLM-Omni 中的具体性能指标(推理速度、显存占用、并发上限等);
  • 是否提供量化版本或多种精度权重;
  • 商用许可条款。

在缺少上述细节前,社区可在 vLLM 项目仓库中跟进 H3 适配的 PR 与文档进展。

信源