桃子桃子快讯
返回首页
行业动态

AMD 年度 AI 大会:押注推理时代的算力蛋糕

AMD 在 Advancing AI 大会上披露推理占比已升至 60%,全球生成式 AI 月度 token 消耗逼近 5…

2026.07.26 · 周日2 分钟阅读

AMD 在硅谷举办了每年一届的 Advancing AI 大会,将焦点放在市场规模、产品路线图以及与英伟达的正面竞争上。CEO 苏姿丰在主题演讲中勾勒出当前 AI 算力市场最关键的拐点:训练向推理的迁移,以及由此引发的硬件需求结构性变化。

训练算力年增 5 倍,推理占比加速抬升

苏姿丰援引数据指出,自 2020 年以来,AI 训练工作负载的算力需求以每年 5 倍的速度增长,且暂无放缓迹象。但真正决定未来市场体量的,是从少数公司主导的训练,向更广泛的推理应用迁移。她在演讲中提到,2024 年 AI 加速器市场中推理与训练的占比约为 40:60,而今年推理占比预计将上升至 60%,训练回落至 40%。行业普遍预期,推理的算力开销最终可能达到训练的 2 至 4 倍乃至更多。

月度 token 消耗逼近 50 万亿

苏姿丰展示的曲线来自 Exponential View《State of the AI Economy》报告,统计了 2024 年 1 月至 2025 年 2 月全球生成式 AI 模型消费与产出的 token 数量。今年 2 月这一数字约为 35 万亿,按指数增长趋势推算,到 7 月底有望突破 50 万亿。这一曲线若持续,将为云厂商、模型厂商以及 AMD、英伟达等芯片供应商正在投入的数千亿美元算力建设提供需求支撑。

关键组件价格同步上行

目前 AI 算力需求仍在超过供给,导致 CPU、GPU、DRAM 内存、闪存、交换 ASIC 与光模块等关键组件价格沿相似曲线上涨。这一供需失衡是 AMD 与整个生态系统共同押注推理时代延续的根本前提。

产品路线图:MI400 与 Venice Epyc 接力

大会上,AMD 也给出了即将到来的产品路线图预告:

  • 「Altair」MI400 架构将以 MI455X 变体率先登场,搭载于 AMD 的「Helios」机架级服务器设计,预计年内通过 OEM 与 ODM 合作伙伴落地。
  • 「Venice」Epyc 9006 系列处理器同样瞄准年内发布,强化在推理与通用计算场景中的 CPU 配套能力。

苏姿丰在大会尾声总结道:「我们不再讨论 AI 可能带来什么,而是正在看到它对每个行业与每个人生活产生的真实而重大的影响。这是 AI 的下一个阶段,也是我们为社会带来有意义现实影响的机会。」

信源