桃子桃子快讯
返回首页
行业动态

太初元碁 WAIC 发布 T2 Ultra 芯片与超智融合计算系统

太初元碁在 WAIC 2026 发布 HCU 架构与 T2 Ultra 芯片,并推出面向 AI 与 AI4S 的超智融合…

2026.07.22 · 周三4 分钟阅读

在 WAIC 2026 上,108 款芯片、超 200 款智算产品齐聚上海,国产算力企业的展示重点正从单卡峰值性能转向系统级协同效率。太初元碁(太初杭州集成电路有限公司)在浦东张江展位发布 HCU 异构融合计算架构、配套的 T2 Ultra 芯片以及元碁 HyperIntelliX 超智融合计算系统,并联合七家单位发布全域大模型安全系统。

从单卡比拼走向系统级竞争

太初元碁 CEO 杨晋喆表示,模型参数突破万亿级后,Agent 与 AI4S 对 CPU-GPU 协同的要求显著提升,单纯堆算力的边际收益正在递减,「降低单位算力成本才是当下真正的核心命题」。这一判断与本届 WAIC 的整体风向一致:华为展出 Atlas 950 SuperPoD 超节点,沐曦发布「曦景」S 系列超节点,阿里平头哥推出真武 M890×磐久 AL128 超节点。国盛证券研报指出,国产超节点迎来量产元年,竞争范式正从单点峰值性能转向系统级全栈效率。

HCU 架构与 T2 Ultra 芯片

HCU 架构的核心思路是将 CPU 与 AI 算力核置于同一条高速总线上,支持 M:N 可重构配比:CPU 负责 Agent 调度与数据预处理,XPA 算力阵列专注大模型推理计算,配合共享分级存储实现冷热数据动态调度。

基于该架构推出的 T2 Ultra 采用双模式设计:

  • 自主计算模式下,芯片可独立承担完整计算任务,适用于边缘或中小规模场景;
  • 加速模式下,可作为加速卡插入大型集群充当「算力引擎」。

性能参数方面,T2 Ultra FP64 算力为 38 TFLOPS,可满足科学计算需求;FP4 稀疏算力达 4800 TFLOPS,FP16 稀疏算力 1200 TFLOPS,原生支持 FP64 至 FP4 全精度覆盖。

面向 AI4S 的平台与生态布局

HyperIntelliX 定位为面向 AI+AI4S 的全国产智算+超算融合平台,已落地气象预测可视化系统、TecoQSim 量子经典模拟器、大规模虚拟药物筛选等项目,覆盖气象、量子计算、生物医药三个方向。太初元碁团队曾三次获得高性能计算领域国际最高奖项戈登·贝尔奖。

生态方面,人工智能开发者社区 2.0 已完成对 Megatron-LM、DeepSpeed、飞桨 PaddleHelix、PyTorch、vLLM 等主流框架的适配;新一代国产 AI4S 计算平台兼容龙芯、申威、飞腾、x86 等主流 CPU,深度适配 PyTorch、JAX、飞桨、MindSpore 等框架并配套 DevKit 开发套件。据公开信息,太初元碁累计完成超 40 款 AI 大模型的即发即适配,并与清华大学、湖南大学、山东大学、百度、东润等高校与企业展开合作。

安全体系与行业坐标

WAIC 期间,河南空港智算中心、瑞莱智慧、太初元碁、安势信息、清源智契、典枢科技、数安信七家单位联合发布全域大模型安全系统,覆盖可信算力底座、大模型安全评测治理、数据合规、软件供应链安全等模块。瑞莱智慧 CTO 徐世真现场介绍了从底层算力到顶层 AI 安全教育实训中心的四层框架。

放在国产芯片版图中观察,华为昇腾 950PR 已量产、FP4 算力 1.56 PFLOPS,2026 年出货目标上调至 150-200 万颗;寒武纪思元 590 在 DeepSeek 推理场景中效率已超越 H20;沐曦股份已登陆科创板,市值一度突破 2800 亿元。太初元碁的差异化路径是构建从芯片、系统到生态的整套 AI 基础设施,但其能否在万卡乃至十万卡规模集群中证明稳定性,以及能否持续降低开发者迁移门槛,仍是从「可用」走向「好用」的关键考验。

信源