桃子桃子快讯
返回首页
行业动态

英伟达AI服务器明年初涨价超15%,1GW数据中心或增50亿美元成本

英伟达通知大客户,AI服务器价格将上调超15%,1GW数据中心建设成本或因此增加至少50亿美元,内存供应紧张是主因。

2026.08.24 · 周一5 分钟阅读

英伟达近日通知部分最大客户,2027 年初交付的 AI 服务器价格将上调超过 15%,原因是内存芯片成本持续飙升。这是英伟达 2026 年以来第三轮大范围涨价,此前的消费级 RTX 50 系列与专业卡 RTX PRO 6000 Blackwell 已先后提价。据估算,仅本轮涨价就可能让一座 1GW 规模的 AI 数据中心多出至少 50 亿美元建设成本。

涨价幅度与涉及产品

据彭博社与 The Information 报道,英伟达旗舰 AI 服务器系统预计涨价约 17%,具体涨幅会因 GPU 代际和内存配置不同而有所差异。此次调价从 2027 年初交付的产品开始生效,主要涉及 Grace Blackwell 300 和下一代 Vera Rubin 200 两大平台。

按当前市场行情估算,一套 72 GPU 的 Vera Rubin 机架价格约 700 万美元,涨价后可能升至约 800 万美元。对于正在扩建超大规模集群的云厂商和大模型公司而言,这意味着数亿美元级别的额外资本支出。

更值得关注的是,英伟达 AI 服务器的部分零部件价格近期波动剧烈。有服务器销售商和 GPU 云厂商透露,组成 AI 服务器的台积电晶圆、先进封装、网络设备、散热系统以及内存等环节,一周内价格波动幅度可达 40%。一位 GPU 云厂商高管表示,其采购的服务器机架近期一度每周涨价 2% 至 3%。

三轮涨价背后的内存困局

英伟达本轮涨价并非孤立事件。回看 2026 年,公司已经经历了三轮大范围价格调整:

  • 消费市场:RTX 50 系列显卡零售价大幅上涨,其中 RTX 5060 Ti 16GB 中位价最高上涨约 39%,RTX 5070 上涨约 36%,RTX 5060 上涨约 27%,RTX 5090 上涨约 9%。
  • 专业 GPU:RTX PRO 6000 Blackwell 官方报价从 2025 年初约 8565 美元,一路涨至 2026 年 8 月的 16000 美元,绝对涨幅达 2750 美元。
  • AI 服务器:Grace Blackwell 与 Vera Rubin 系统涨价超 15%,是本轮关注度最高的一次。

三轮涨价的共同推手是内存。TrendForce 预计,2026 年第二季度传统 DRAM 合约价环比上涨 58% 至 63%,NAND Flash 环比上涨 70% 至 75%。AI 芯片对 HBM 需求激增,挤占了普通服务器内存的晶圆产能。HBM 本身又因更大的 die 面积、更高的堆叠层数和更复杂的封装流程,进一步压缩了同等晶圆投入下的产出效率。

供需失衡已开始改变客户的配置策略。今年上半年,部分云服务商和服务器 OEM 已将系统中的 96GB、128GB RDIMM 调整为 32GB、64GB 模块以压缩成本。英伟达自身也因 LPDDR5X 供应紧张,将下一代 Vera Rubin Superchip 的 SOCAMM 内存容量削减一半。TrendForce 预计,2027 年服务器 RDIMM bit 供应同比仅增长 15% 至 20%,明显落后于服务器 CPU 出货增速。

英伟达向基础设施上游延伸

面对芯片以外的成本压力,英伟达开始向上游基础设施环节布局。8 月 21 日,公司宣布对美国数据中心基础设施开发商 Cloverleaf Infrastructure 进行少数股权投资,具体金额未披露,但《华尔街日报》报道称可达数亿美元。Cloverleaf 专注于为数据中心寻找土地、协调电力与公用事业资源,将零散条件打包为可建设的数据中心项目。合作后,Cloverleaf 将部署英伟达 DSX 平台,用于优化选址、电力、冷却与计算基础设施规划。

在此之前,英伟达刚刚宣布向软银旗下数据中心开发商 SB Energy 投资 15 亿美元,并与 Apollo、BlackRock、Blackstone、Brookfield、高盛、KKR 等机构合作,希望撬动超过 5000 亿美元第三方资金用于 AI 基础设施建设。

与此同时,Amazon、微软、Google 和 Meta 都在加码自研 AI 芯片,以降低对英伟达的依赖。英伟达的关注范围已从「芯片能否造出来」,扩展到「客户买不买得起」「数据中心建在哪里」「电从哪里来」「GPU 何时能通电运行」等更上游的问题。

One More Thing:AVO 优化 GPU 内核

在硬件价格不断上行的同时,英伟达也在尝试用软件提升 GPU 利用率。公司最新公布的 AVO 研究,先让 Agent 自动优化 GPU 内核,再迁移到 ARC-AGI-3 测试。官方披露,AVO 探索了 500 多个优化方向,提交 40 个内核版本,在 DGX B200 上较 FlashAttention-4 最高快 10.5%。这意味着即便硬件成本继续攀升,英伟达仍在通过计算效率的提升,为客户争取更优的总体拥有成本。

信源