Perplexity 宣布推出一项名为 Hybrid Compute(混合计算)的新功能,允许用户把一项任务同时拆分给云端前沿模型和本地大语言模型处理——其中敏感信息交给本地模型,确保相关数据始终安全地留在用户自己的设备中。
上传即检测敏感内容,本地模型一键安装Perplexity Mac 产品负责人 Jon Staff 介绍,这项功能直接集成在 Mac 应用中:“每当你尝试上传文件或发送信息时,系统都会自动检查其中是否包含敏感内容,并确认你是否愿意将这些数据分享至云端。”
为此,Perplexity 还训练了一种新的隐私分类器,能够自动建议用户应当保留在电脑本地的文件和信息。在任务正式分配给不同模型之前,用户可以先查看系统准备隔离、留在本地的文件,确认没有遗漏重要内容,并自行决定由哪些模型来完成任务。
目前可用的本地模型包括 Gemma E4B,以及两个版本的 Qwen 3.6 模型,其中两个 Qwen 3.6 版本均拥有 350 亿参数,且其中一个经过 Perplexity 的后训练。公司表示未来还会提供更多本地模型。无论选哪一种,安装过程都不需要打开 Mac 终端,由 Perplexity 应用自动完成。运行期间,用户可以看到本地 CPU、GPU 和内存使用情况的可视化信息,侧栏则显示任务已消耗的令牌数量;本地模型生成的令牌不产生费用,结果产出后仍可继续输入后续指令,也能通过 iPhone 将任务加入队列。
云端更强但更贵,这是一条“可调节的尺度”当被问及是否将混合计算的结果与纯云端方案做过基准测试时,Staff 坦言:“简短来说,如果只看原始产物的生成质量,完全使用前沿模型的输出几乎总是更好。它的成本更高,但能力也更强。”不过他补充说,并非所有用户都需要最先进、最强大的模型来完成工作,在这类情况下,数据隐私和成本可能比模型能力更重要。
“我认为这应该是一条可调节的尺度……我们会根据掌握的上下文,尝试推荐最合适的方案,但最终仍应由用户决定哪种解决方案最符合自身需求。”Staff 表示。
目前,Hybrid Compute 仅适用于搭载 Apple Silicon 芯片、运行 macOS 15 的 Mac 电脑,Perplexity 建议设备至少配备 32GB 统一内存。该功能面向 Pro 和 Max 订阅用户以及企业客户开放。

