Perplexity于9月1日宣布推出Hybrid Compute功能,该工具集成于Mac应用中,允许用户将AI任务在云端前沿模型与本地运行的开源模型之间拆分,以保护敏感信息并降低推理成本。Perplexity表示,该功能适用于律师等需要处理机密数据的场景,用户可将案件材料留在本地,仅将非敏感部分交由云端模型处理。

据Perplexity介绍,Hybrid Compute启动时,系统会自动通过本地运行的PII分类器检测任务中的姓名、地址、账号等敏感信息,并将其替换为占位符,待云端模型返回结果后再恢复。该分类器由Perplexity安全智能研究所协作训练,并已开源。用户可在任务开始前检查被筛选出的文件,并自由选择参与处理的本地模型和云端模型。本地模型目前包括Gemma E4B及两种版本的Qwen 35B参数模型,其中一种由Perplexity进行后训练。本地模型安装无需终端操作,应用会自行处理。

运行过程中,Perplexity会可视化显示本地CPU、GPU及内存占用,并展示任务消耗的令牌数。本地模型生成的令牌不会产生云端费用。任务完成后,用户可正常发送后续指令,也可通过iPhone远程排队任务。Perplexity负责Mac产品的Jon Staff表示,完全由前沿云端模型生成的输出在原始内容创作上通常质量更高,但部分用户更看重隐私和成本,用户可根据具体工作需求在两者间自主权衡。

据9to5Mac报道,Perplexity最早于今年6月宣布相关研发计划,此次发布是Mac应用的最新更新。该功能仅支持搭载Apple Silicon且运行macOS 15的Mac,最低需24GB统一内存,推荐32GB。Pro、Max订阅用户及企业客户可使用。Perplexity还提到,配备8GB或16GB内存的Mac无法运行该功能。此前,Perplexity已被苹果在M6 Mac mini发布会上作为生产力应用案例引用。