桃子桃子快讯
返回首页
产品功能

Perplexity 即将上线 Mac 端 Hybrid 模式:云端编排 + 本地模型协作

Perplexity 将在 Mac 端推出 Hybrid 模式,由云端 Computer 编排任务并将合适的子任务交给本…

2026.08.31 · 周一3 分钟阅读

Perplexity 即将为其 Mac 客户端上线一项名为「Hybrid 模式」的新能力。区别于当前完全依赖云端的运行方式,Hybrid 模式会在云端完成整体编排,同时把部分适合的子任务委派给运行在用户 Mac 上的本地模型来处理,从而兼顾云端大模型的调度能力与本地推理的隐私、低延迟特性。

模式核心:云端编排 + 本地推理

据披露的官方说明,Hybrid 模式的运行逻辑可以概括为:

  • 云端 Computer 负责整体任务编排,决定哪些子任务适合下放到本地。
  • 本地模型基于 Mac 自身的内存和处理器运行,机器性能越强,可承载的模型规模越大。
  • 任务在云端与本地之间按需切换,并非简单的「全部云端」或「全部本地」二选一。

这一设计意味着,用户可以在不把全部请求都暴露给云端的前提下,利用本地模型处理一部分推理工作。

本地模型支持与硬件门槛

首批支持的本地模型及其适用机型如下:

  • Gemma 4:面向配备 16 GB 内存的 Mac。
  • Qwen3.6:同样面向 16 GB 内存级别的机型(注:原文写法为 Qwen3.6,尚不确定是否为正式版本号)。
  • Perplexity 自研模型:面向 32 GB 内存的 Mac,能力上限更高。

可以看出,Perplexity 采用了「按硬件分级匹配不同本地模型」的策略:低内存机型使用更轻量模型,高内存机型则可以跑自家更大的模型。

Privacy Gate:上云前的隐私把关

Hybrid 模式中另一个关键组件是 Privacy Gate,它是一个完全运行在 Mac 本地的小模型。其作用是:

  • 检查任何准备送往云端的内容中是否包含个人或敏感信息。
  • 一旦识别到敏感数据,由用户决定如何处理(如拦截、脱敏或放行),在数据真正上传之前完成审核。

这相当于在「本地推理」与「云端推理」之间插入了一道用户可控的隐私关卡,与 Hybrid 模式的整体定位形成呼应。

现状与待观察点

目前 Hybrid 模式标注为「即将上线」,尚未公布具体的开放时间、免费/付费范围,以及是否仅限订阅用户。从产品形态看,它更像是 Perplexity 在「端云协同」方向上的一次系统性尝试——既不像纯本地方案那样受限于硬件,也不像纯云端方案那样依赖网络。后续值得关注的点包括:实际推理质量与纯云端模式的差距、Privacy Gate 的误判率、以及更大内存机型上 Perplexity 自研模型的实际表现。

信源