2026 年 9 月 1 日,Perplexity 宣布为其 AI 智能体平台“Perplexity Computer”推出新功能“Hybrid Compute”(混合计算)。该功能可以把一项任务拆分给云端的前沿大模型和 Mac 上运行的本地模型:客户信息、合同等不希望外泄的数据由设备内的模型处理,而资料搜集和推理则交给云端。只要是搭载 Apple 芯片的 Mac,无需额外硬件即可使用。

同一任务由云端与设备分工完成

Perplexity Computer 于 2026 年 2 月推出,是一个把模型、文件、工具和网络访问组合起来完成多步骤工作的智能体平台。4 月加入的“Personal Computer”让它可以直接操作 Mac 上的文件和应用,此次的 Hybrid Compute 正是在这一基础上的延伸。

原理并不复杂。用户提交一项任务后,Computer 会把它拆成面向云端和面向设备的两部分。云端的顶级模型负责高级推理、网络搜索和制定工作计划;Mac 上的本地模型则负责读取私人文件、处理敏感信息,以及执行设备内所需的操作。用户不必把任务拆成两条提示词,也不必手动在工具之间搬运结果,整个流程由 Computer 统一协调。

开始工作前,应用会显示哪些文件建议留在设备内,用户可以亲自确认是否有遗漏。在这一步还可以分别选择本地端和云端使用的模型。

“隐私门”盯着离开设备的信息

这项功能的核心是运行在 Mac 上的“隐私门”(privacy gate)。Perplexity 新训练的分类器在设备内运行,会在信息发往云端之前识别姓名、地址、账号、登录凭据等敏感要素。根据检测结果,它可以对相关内容打码后再发送、保留在设备内、直接拒绝该操作,或者征求用户同意。

其中,登录信息、信用卡号和政府颁发的身份证号受到最严格的保护:要么不离开设备,要么把这些信息剔除后再改写请求交给云端模型继续处理。

同一天,Perplexity 还公开了这一分类器背后的研究成果:用于衡量在多轮长对话中能否完整捕捉反复出现的同一个人信息的基准测试“PII-TRACE”,以及参数量 6 亿的检测模型“PII-Tracer”。该基准覆盖 13 种语言、13,148 段对话。据 Perplexity 的测试,对于反复出现的标识符,PII-Tracer 做到全部检出的比例为 79.4%,而作为对照的云端大模型为 57.0%。两者均计划近期发布。

面向企业提供管理员规则与审计功能

这一设计明显瞄准了法律、医疗、金融等每天都要处理机密数据的行业。在 Perplexity 举的例子中,投资团队在云端收集公开文件和市场数据,本地模型则负责比对未公开的交易文件并提取关键条款;广告公司在云端做市场调研,而对外保密的创意稿件在设备内审阅;律师在网上检索判例,涉及律师保密特权的文件摘要则在 Mac 上生成。

对于 Enterprise 订阅用户,管理员可以为整个组织设定规则:哪些信息必须留在设备内,哪些信息打码后即可发往云端,哪些信息在发送前需要用户批准。系统还提供审计功能,记录信息何时离开了设备,方便团队以一致的规则运作。

支持环境与可用模型

Hybrid Compute 现已向 Pro、Max 和 Enterprise 订阅用户开放。运行环境为 macOS 15 及以上版本的 Apple 芯片 Mac,统一内存至少需要 24GB。也有说法建议 32GB 以上以获得更流畅的体验,8 月发布的新款 Mac mini 和 Mac Studio 被点名为理想的运行平台。

首批提供 3 款本地模型:Google 的“Gemma 4 E4B”、阿里巴巴的“Qwen3.6 35B-A3B”,以及 Perplexity 基于 Qwen 系列专门为 Perplexity Computer 追加训练的模型。安装无需打开终端,在 Mac 应用中一键即可下载。Perplexity 表示今后会继续增加可选模型。

任务运行期间,应用会可视化显示 Mac 的 CPU、GPU 和内存占用,旁边还会显示该任务消耗的 token 数量。本地模型生成的 token 不收费,只有使用云端模型的部分才会产生费用。用户还可以从 iPhone 提交任务,因此把一台常开的 Mac mini 放在家中,在外出时处理手头的机密数据也是可行的用法。

与纯云端的性能差距“由用户来定”

大家最关心的,是与全部交给云端处理相比质量差多少。负责 Perplexity Mac 产品的 Jon Staff 承认,就成果本身的质量而言,完全使用云端顶级模型几乎总是更好。但他同时指出,并非所有人都需要性能最强的模型,在不少场景下数据隐私和成本更为重要,重心放在哪里应当由用户自行调节。

笔者认为这种坦率的态度值得肯定。Perplexity 没有夸大本地模型的能力,而是明确了分工:需要保护的留在设备内,需要性能的交给云端,这让考虑引入的一方更容易做判断。8 月,Perplexity 还面向 NVIDIA DGX Spark 推出了完全在设备内运行的“Portable Computer”。从纯云端到纯本地之间的空白,正被这家公司一格一格地填满。

总结

Perplexity 的“Hybrid Compute”把一项任务拆分给云端大模型和 Mac 上的本地模型,并通过设备内的隐私门保护敏感信息,让用户可以放心使用智能体。该功能面向 Pro、Max 和 Enterprise 订阅用户,只要拥有 macOS 15 及以上、统一内存 24GB 以上的 Apple 芯片 Mac 即可使用。加上本地处理部分不收费,这次发布可以说为把 AI 智能体引入业务提供了一个务实的折中方案。