Perplexity为其代理平台Computer推出了Hybrid Compute功能,试图结合先进云端模型的能力与本地处理的隐私性。该功能允许代理在云端开始任务,然后将涉及私有文件或设备上数据的部分委派给运行在搭载Apple silicon芯片的Mac设备上的本地模型,无需重新启动任务,也不会丢失上下文。
该功能自2026年9月1日起可用,面向选择启用该功能的企业客户,以及Pro和Max订阅者;设备要求为搭载Apple silicon芯片且运行macOS 15或更高版本的任何Mac。公司没有在材料中提及支持Windows或Linux的具体时间,只表示支持将在稍后推出。
平台如何分配任务的不同部分?
该架构充当协调层或任务分发器。云端的高级模型负责将请求拆分为子任务,然后决定每项任务的执行位置。网页搜索、长期规划和高强度推理任务可以留在云端,而接触私有文件、本地数据或设备操作的流程则会发送给运行在Mac上的子代理。
Perplexity依赖其称为Privacy Gate的功能。这是公司训练的分类器,在设备上运行,用于在任何内容传输到云端之前检查个人身份信息,例如姓名、地址、账号和机密信息。检测到敏感数据后,用户可以选择相关部分是在本地执行,还是与云端协调器共享。公司表示,本地执行产生的令牌不会离开设备。
本地模型与不同的成本
发布时,用户可以在三个本地模型之间进行选择:Google的Gemma E4B、Alibaba的Qwen3.6 35B-A3B,以及由Perplexity重新训练的Qwen3.6 35B版本,该版本是公司推荐的模型。Perplexity负责macOS和iOS工程团队的Jon Staff表示,在本地运行Qwen模型不会将令牌发送给托管在其他国家的云服务提供商;他还指出,公司的模型托管在美国。
根据Staff的说法,本地执行生成的令牌不会计入使用额度,而额度会用于协调和云端委派。不过,Perplexity建议使用不少于32GB统一内存来运行更强大的本地模型系列;Staff承认,较小的模型表现比更大的Qwen模型弱得多。
这对企业实际意味着什么?
Perplexity展示了针对难以将完整数据发送给云端代理的业务场景。在一个法律示例中,系统在本地处理机密案件文件,同时通过网页搜索公开的判例;据公司称,它只发送了经过匿名化的法律问题。在另一个示例中,代理处理了一份基于机密管理层预测的财务模型,将其与公开数据进行比较,然后在后台约40分钟内生成了投资委员会演示文稿的第五版。
用户还可以从iPhone启动任务,并允许Computer访问远程Mac,使本地设备处理客户访谈和收入数据,同时云端代理搜索公开的竞争对手价格。对于企业,Perplexity允许管理员在组织层面应用统一的敏感度策略,并审计每台设备上发送出去的完整记录;这些功能尤其面向法律、金融和医疗行业的合规团队。
为什么这一发布很重要?
该产品试图解决一个实际的权衡问题:最需要高准确性的工作往往依赖企业不愿发送到外部服务器的数据,而仅依靠本地模型时,模型在搜索、规划和推理方面的能力可能较弱。因此,Perplexity并未将混合处理定位为云端或本地设备的完全替代方案,而是将其作为一层决定任务各部分执行位置的机制。
但这种保护并非绝对保证。隐私网关本身就是一个基于机器学习的分类器,可能无法发现某些敏感数据。公司表示,用户可以在发送前查看网关检测到的内容,企业也可以获得设备级审计日志;不过,这一机制的实际有效性将取决于分类器的准确性,以及各企业制定的审核政策。此外,非企业账户使用数据的细节仍需要进一步说明;公司表示不会在全球范围内使用这些数据进行后续训练,并承诺提供针对非企业账户的详细信息。