桃子桃子快讯
返回首页
产品功能

中诚华隆发布 HL200 推理芯片及万卡超节点集群

中诚华隆推出二代 HL200 推理芯片与最高万卡级超节点集群方案,主打国产高并发、低时延推理算力。

2026.08.24 · 周一3 分钟阅读

中诚华隆近日在北京举办 2026 GPU 新品发布会,正式推出第二代 HL200 推理芯片及配套的超节点智算集群方案,覆盖从单卡到万卡级的国产 AI 推理算力部署需求。发布会吸引来自工信部、中国科技咨询协会及产业链上下游百余位代表参加。

HL200 芯片:聚焦低精度与高能效

HL200 定位推理专用 GPU,原生支持 FP4、FP8 超低精度并兼容 FP16,覆盖主流大模型推理精度需求。芯片官方公布的单卡关键算力指标如下:

  • FP16/BF16 算力:0.5 PFLOPS
  • FP8 算力:2 PFLOPS
  • FP4 算力:4 PFLOPS
  • 能效比:5.12 TFLOPS/W

生态适配方面,HL200 兼容 PyTorch、ONNX、vLLM 等主流框架,并提供 OpenAI 兼容接口与轻量化迁移工具。中诚华隆表示,HL200 已在 DeepSeek V4 Flash、DeepSeek V4 Pro、GLM 5.2 等模型的对标适配测试中,Prefill 全流程性能与解码延迟相对国际同级产品具备优势,但官方未披露具体对比基准与测试条件。

万卡超节点集群:从单卡到 10240 卡扩展

面向万亿参数大模型的推理算力需求,中诚华隆同步发布 HL200 超节点智算集群方案,主要扩展能力包括:

  • 单机柜:64 张 GPU 高速互联
  • 单节点:纵向堆叠最高 1024 卡
  • 横向扩展:最高 10240 卡

方案围绕算、存、网全链路 SLO 协同优化,重点提升互联带宽、部署时延与能效表现,旨在为政务、金融、能源、交通等领域的智算中心提供从 8 卡到万卡的全场景部署路径。

产业生态与落地进展

发布会上,中诚华隆与中国能建旗下中电工程、浪潮信息、紫光智算、光环云等十余家企业签署战略合作协议,意在共建国产 AI 算力生态。公司透露,核心产品已中标中国移动、中国电信等头部运营商,并在全国 20 余省份、近 50 个重点标段落地,应用于政务、金融、能源、交通等国家关键信息基础设施领域。

中诚华隆董事长王嘉诚表示,行业算力竞争已从参数比拼转向推理效率、落地体验与产业价值的综合比拼,公司将持续围绕「芯片 + 整机 + 解决方案」全栈自主可控能力,推动国产推理算力从「可用」走向「好用、易用、普惠」。需要指出的是,发布会通稿由企业自行提供,部分性能描述使用「全面领先」「国内第一梯队」等表述,缺少独立第三方基准数据,读者在参考其技术指标时宜结合后续独立测评交叉验证。

信源