桃子桃子快讯
返回首页
行业动态

AMD Advancing AI 2026 大会前瞻:能否在 AI 工厂赛道分一杯羹?

AMD 明日将发布 Zen 6 与 MI455X,推理市场订单与认股权证机制是真实进展,但训练市场的短板与 NVIDIA…

2026.07.22 · 周三6 分钟阅读

AMD Advancing AI 2026 大会今日开幕,CEO 苏姿丰将在明天(7 月 23 日)发表主题演讲,预计正式发布 Zen 6 EPYC Venice 服务器处理器与 MI455X 系列 AI 加速器。大会的核心命题是:AMD 能否把已经拿下的推理市场订单,转化为更宏大的「AI 工厂」叙事,从而在 NVIDIA 主导的 AI 算力市场中占据更稳固的位置。

大会看点:Zen 6 与 MI455X

AMD CTO Mark Papermaster 已提前剧透,Zen 6 将在大会正式亮相,这是一次架构级换代。Venice 采用台积电 2nm 工艺,标准版最高 96 核,密集版 Zen 6c 最高 256 核、512 线程;AMD 称相比 Zen 5 的 Turin 性能提升超 70%。平台层面,插座升级至 SP7,TDP 区间 700–1400W,配备 16 通道 DDR5、PCIe 6.0,单插槽内存带宽达 1.6TB/s。

GPU 端的重点大概率是 MI455X。该产品在 CES 2026 已预览过,采用 CDNA5 架构,搭载 432GB HBM4,FP4 算力 40 PFLOPS。搭配 Venice CPU 组成 Helios 机架级参考设计,单节点配置 4 颗 MI455X + 1 颗 Venice,单机架 FP4 算力达 2.9 exaFLOPS。Meta 已宣布 2026 下半年部署基于 Helios 的机架,OpenAI 也签下 6GW MI450 的多代合作订单。

值得留意的是 AMD 自称的「100kW 机架级别,Venice 性能是 NVIDIA Vera 的 3.3 倍」——AMD 在方法论文档中已明确说明,这一数字基于模型估算,而非实测机架级 benchmark。

推理市场:小饼确实烤得不错

AMD 在推理市场获得的订单是真金白银,且采用了「股权换订单」机制。Meta 把 100% 的 Llama 405B 推理跑在 MI300X 上,签下一份 60–100 亿美元的多年合同,附带最多 1.6 亿股 AMD 认股权证,行权门槛对应股价 600 美元。OpenAI 的 6GW MI450 合作同样附带 1.6 亿股认股权证。两笔合计最高 3.2 亿股,若全部行权潜在稀释约 20%,前提是 2026–2030 年完成 6GW 部署并触及股价门槛。

定价方面,MI300X 在云平台上约 1.80–2.30 美元/GPU·小时,比 H100 的 5.01 美元/GPU·小时便宜 40%–60%;192GB HBM3 容量也比 H100 的 80GB 多出一倍有余,大模型推理无需拆分到多卡。在 MLPerf Inference 上,MI355X 可达 NVIDIA B300 的 92%–104% 性能,差距已显著缩小。ROCm 7.x 对 PyTorch、vLLM、Llama、Qwen 等主流开源框架的支持也比两年前成熟得多。

商业层面,7 月 20 日微软 Azure 官宣规模化部署基于 Helios 的机架,并新增两款基于 EPYC Venice 的虚拟机(HDv2 面向代理式 AI 与数据管道,HXv2 面向 EDA)。微软由此成为 AMD 首个「GPU + CPU + 网络」全栈超大规模云客户。AMD Q1 财报显示,数据中心营收 58 亿美元,同比增长 57%;Q2 总营收指引 112 亿美元,同比 +46%。

AI 工厂叙事仍缺关键一环

真正的 AI 工厂需要训练 + 推理的完整闭环。训练是上游,定义模型架构、框架标准与开发者习惯,这是 NVIDIA 长期占据主场的领域。NVIDIA FY2026 数据中心营收约 1937 亿美元,AMD FY2025 仅约 166 亿美元,量级差距超过一个数量级。即便对齐 FY2026 Q1 单季,NVIDIA 约 391 亿、AMD 58 亿,差距仍有约 6.7 倍。NVIDIA 在训练市场份额超过 80%,短期内难以撼动。

训练性能层面,MI300X 实际工作负载只能达到不足 30% 的理论峰值(据第三方实测),而 H100 可达 40% 左右;多节点训练差距更大,且规模越大劣势越明显。SemiAnalysis 的结论很直接:AMD 的训练性能每美元成本仍逊于 NVIDIA。客户迁移到 AMD 训练平台,意味着整个软件栈、工具链与工程师习惯的重学,这用钱解决不了,需要时间——而时间站在 NVIDIA 一边。

国内市场方面,昇腾 950 超节点、曙光 8000 全国产十万卡集群在 WAIC 2026 亮相,国产大模型深度适配国产芯片形成闭环;昇腾系推理芯片单位算力成本比 MI300X 低 30%–50%,且受国产化率要求驱动,但这类压力基本局限于本土市场,AMD 的海外推理基本盘仍较稳固。

关键变量:明天的主题演讲与 8 月 4 日的 Q2 财报

市场真正想听见的不是新口号,而是硬数字:MI450 能否给出具体量产时间表与客户名单;Zen 6 定价是否足够激进,能否在 NVIDIA Vera 与 Intel 至强夹击下守住 x86 基本盘;台积电 2nm 产能是否会构成实际瓶颈。这些问题能否在明天得到令人信服的回应,将决定 AMD「AI 工厂」叙事能否跨越从推理到训练的临界点。

信源