桃子桃子快讯
返回首页
行业动态

Perplexity 联手英伟达,推零 Token 成本本地 AI 智能体设备

Perplexity 与英伟达宣布合作,推出一款可本地运行的便携式 AI 智能体设备,推理无需按 Token 付费。

2026.08.25 · 周二2 分钟阅读

AI 搜索公司 Perplexity 与芯片巨头英伟达(NVIDIA)宣布建立合作关系,将共同推出一款主打本地推理的便携式 AI 智能体设备。该设备最核心的卖点是「零 Token 成本」——即所有推理任务都在本地完成,用户无需为模型调用按 Token 计费,从而摆脱云端推理 API 的持续开销。

合作背景:搜索厂商与算力巨头的联手

Perplexity 一直以 AI 驱动的问答与搜索产品见长,而英伟达则是当前 AI 加速计算硬件的事实标准提供者。双方此前在英伟达 NIM(NVIDIA Inference Microservices)等推理微服务生态上已有接触,本次合作可视为将软件能力与本地算力进一步打包的尝试。

从产品形态看,这款设备被官方描述为一台「便携式计算机」(portable computer),意味着它并非单纯的开发板或工作站,而是一款面向终端用户、可随身携带的独立硬件。

核心卖点:本地推理 + 零 Token 成本

此次发布的产品定位有几个关键特征:

  • 本地运行:智能体所需的推理完全在设备端完成,不依赖云端 API。
  • 零 Token 成本:用户购买设备后无需再为模型调用支付按量费用,长期使用成本可预期。
  • 智能体形态:产品以「agent」为定位,意味着并非单纯的问答工具,而是能够自主规划、执行多步任务的 AI 助手。

这一组合直接对标了当前主流大模型使用方式中的一大痛点——云端 API 的持续支出。对开发者与重度 AI 用户而言,本地化、一次性买断的方案具备明显的成本可预测性优势。

行业意义与待观察点

对 AI 硬件赛道而言,此次合作具有一定风向标意义:头部大模型应用层厂商开始主动下场做端侧设备,意味着「应用 + 芯片」垂直整合的趋势正在加强。若产品体验与本地模型能力达到可用水平,可能挤压部分云端推理 API 的市场空间。

不过,本次报道披露的细节仍较为有限,例如:

  • 具体硬件配置(使用的英伟达芯片型号、显存与算力规格)尚未公开;
  • 本地运行的具体模型规模与能力边界未给出;
  • 设备定价、上市时间与目标用户群仍有待官方进一步公布。

后续值得关注的,是该设备能否在本地模型性能上真正对标云端主流大模型,以及 Perplexity 是否会借此切入更广泛的消费级 AI 硬件市场。

信源