@LinusEkenstam:Perplexity中的本地模型 就在下周Apple活动前夕,Perplexity再次展示了前进的道路 f…
摘要
Perplexity为其Mac应用引入混合计算,使本地模型能够对敏感数据进行推理,同时将部分计算卸载到云端,这标志着透明本地AI使用的趋势。
查看缓存全文
缓存时间: 2026/09/03 08:11
Perplexity 支持本地模型 恰逢下周苹果发布会,Perplexity 再次指明了一条推理混合化的前进道路。 这开启了一种我期待的趋势:让本地模型的运作透明化且易于协作,并支持向云端分流处理。
Aravind Srinivas (@AravSrinivas): 我们正在为所有 Perplexity Mac 应用用户引入混合计算功能。 这将使计算机能够编排可在 Mac 本地运行的模型,特别适用于涉及敏感与隐私文件(例如您的体检报告、税务申报、诉讼文件等)的智能体任务步骤。
相似文章
数据中心移动到你的设备上(4分钟阅读)
Perplexity在2026年台北国际电脑展上发布了一款混合本地-云端推理系统,该系统能智能地在设备端模型和云端模型之间路由查询,基于其早前的Personal Computer agent构建。
@LinusEkenstam: 相当重要的进展。比MLX-LM推理速度快1.35倍,在预填充阶段速度快1.23倍,能够从内部选择混合选项。
Perplexity已经开源了Lily,这是一个针对Apple Silicon优化的本地推理引擎,专门用于Qwen3.6-35B-A3B模型,实现了比MLX-LM快1.35倍的推理速度。
Perplexity 开源其针对 Qwen 3.6 的 Mac 推理服务器
Perplexity 开源了一款针对 Qwen 3.6 模型优化的 Mac 推理服务器,以在 Apple Silicon 上实现最佳性能。
本地模型优化(3 分钟阅读)
本文分析了在 MacBook Pro 上本地运行 AI 推理的可行性,对比了本地 Qwen 35B 模型与云端 Claude Opus 4.5。结论是,对于常规任务,本地模型速度快 2 倍,尽管在能力上略有差距,但仍是日常工作量中一半任务的实用选择。
Perplexity 与 Nvidia 合作推出 Portable Computer,一个完全本地化的 AI 代理,零令牌成本(13 分钟阅读)
Perplexity 与 Nvidia 合作推出 Portable Computer,一个完全本地化的 AI 代理,运行在用户自有的硬件上,如 DGX Spark 和 RTX GPU,消除了云令牌成本并保持数据私密。