桃子桃子快讯
返回首页
行业动态

英伟达 Vera Rubin 全面量产,Vera CPU 性能首次曝光

英伟达披露 Vera Rubin NVL72 进入量产爬坡,300+ 合作伙伴部署;Vera CPU 面向代理式 AI…

2026.07.22 · 周三6 分钟阅读

英伟达正在将战火从 GPU 烧向 CPU。当地时间 21 日,在 AMD 举行 AI 相关活动前夕,英伟达集中披露了下一代 Vera Rubin 平台的最新进展:Vera Rubin NVL72 已进入量产爬坡阶段,供应链覆盖全球 350 多个工厂和 30 个国家,超过 300 家合作伙伴参与。同时,英伟达公布了自研 Vera CPU 及 Vera Rubin 平台在 AI 智能体(agent)工作负载中的详细性能数据,试图证明随着 AI 从「回答问题」转向自主规划与执行,CPU 正在成为 AI 基础设施的新战场。

Vera Rubin NVL72 进入量产爬坡

英伟达表示,Vera Rubin NVL72 整套系统已交付给首批客户。CoreWeave、谷歌云、微软 Azure 和甲骨文 OCI 等云服务商开始部署相关机架;戴尔、慧与企业(HPE)、联想、超微等服务器厂商也在推进基于 Vera 的整机系统。客户名单已涵盖 Anthropic、OpenAI、SpaceX、字节跳动和 Oracle Cloud Infrastructure 等。

核心合作进展包括:

  • CoreWeave 用 Vera Rubin NVL72 运行 DeepSeek-R1 测试,称相比上一代 Grace Blackwell NVL72,每兆瓦每秒生成的 Token 数提升 10 倍。
  • Google Cloud 已推出基于 Vera Rubin NVL72 的 A5X 实例,英伟达称其在特定场景下可实现更低推理成本与更高每兆瓦 Token 吞吐量。
  • 平台整合了自研 Vera CPU、Rubin GPU、网络与数据处理芯片,并纳入基于 Groq 技术打造的 Groq 3 LPX 推理加速机架,覆盖训练、后训练、测试时扩展与实时推理全流程。

英伟达此前已于今年 5 月宣布 Vera CPU 进入全面生产、并在 5 月至 6 月向 Anthropic、OpenAI、SpaceX 完成首批系统交付。Wolfe Research 估算,Vera 单颗均价约 5000 美元,2025 年出货量预计约 130 万颗。

Vera CPU:面向代理式 AI 重新设计

Vera 被定位为英伟达首款专为代理式 AI 设计的 CPU,搭载 88 颗自研 Olympus 核心,配备 1.2 TB/s 内存带宽。在最新披露的基准测试中:

  • 单线程性能达竞品 2 倍;
  • 核心间通信带宽达竞品 3 倍;
  • 相比竞争性芯粒设计,内存延迟降低 40%;
  • 在特定任务上完成速度达 x86 CPU 的 1.8 倍(5 月已公布,本次再次强调)。

英伟达刻意避开传统 x86 CPU 「堆核心数量」的设计路线,转而押注单线程性能、核心间带宽与内存访问延迟。其逻辑是:GPU 是 AI 数据中心最昂贵、最稀缺的资源,CPU 越快完成任务,GPU 的「空转等待」就越少,整座 AI 工厂的利用率就越高。

在客户 DeepInfra 的生产环境测试中,Vera 最多支持 1.6 倍并发 AI 代理数量,任务编排速度最高提升 2.2 倍。需注意这些数据来自特定测试环境,并不意味着 Vera 在所有通用 CPU 工作负载中全面领先。

AI 智能体驱动 CPU 重新成为关键瓶颈

英伟达押注 CPU 的根本原因,是 AI 工作负载的性质正在改变。

在传统生成式 AI 中,GPU 承担模型推理主体计算,CPU 更多负责外围调度。但 AI 智能体需要自主拆解任务、调用工具、运行代码、检索长上下文并反复评估结果,每一次工具调用与任务编排都意味着 CPU 必须频繁处理低延迟、实时性请求。

英伟达判断「代理式 AI 正在创造一个新的 CPU 时刻」,并预计服务器 CPU 市场的长期规模可能达到 2000 亿美元——远超传统企业服务器 CPU 市场,因为市场边界将扩展到 AI 推理、智能体、强化学习、数据处理与编排任务等场景。

竞争焦点从芯片升级为整座「AI 工厂」

Vera CPU 只是英伟达更大系统战略的一个组件。在 Vera Rubin 平台中,英伟达将 CPU、GPU、网络、推理加速与软件调度整合为机架级甚至数据中心级方案,直接以「AI 工厂」形态向客户交付。

这意味着英伟达的竞争对象已不再局限于 AMD Instinct GPU 或英特尔 Gaudi 等单颗加速芯片,而是覆盖整套 AI 基础设施。对于长期主导服务器 CPU 市场的 AMD 和英特尔而言,真正的威胁在于:英伟达无需在传统 CPU 维度正面竞争,而是可以从代理式 AI、强化学习与高性能 AI 推理等高增长场景切入,再向外扩展 CPU 的应用范围。

不过,CPU 市场从来不只是芯片性能的竞争,软件生态、客户认证、服务器兼容性与长期供应关系同样关键。大型云服务商和企业客户的硬件平台切换往往需要多年时间。Vera 能否从 AI 专用场景扩展到更广泛的服务器市场,最终仍取决于客户能否获得足够明显的性能和成本优势。

如果代理式 AI 真的成为下一轮计算需求增长的核心驱动力,那么英伟达将争夺的,可能不仅是 GPU 份额,而是整个 AI 服务器计算价值链——AMD 与英特尔面对的竞争维度,也将被彻底改写。

信源