@LinusEkenstam: 相当重要的进展。比MLX-LM推理速度快1.35倍,在预填充阶段速度快1.23倍,能够从内部选择混合选项。

X AI KOLs Timeline 工具

摘要

Perplexity已经开源了Lily,这是一个针对Apple Silicon优化的本地推理引擎,专门用于Qwen3.6-35B-A3B模型,实现了比MLX-LM快1.35倍的推理速度。

相当重要的进展。 比MLX-LM推理速度快1.35倍 在预填充阶段速度快1.23倍 在Perplexity内部能够选择混合选项真是太棒了。看到Lily被开源更是锦上添花。 任何人都可以利用这个,操作系统可以将其推向更远。
查看原文
查看缓存全文

缓存时间: 2026/09/03 12:09

相当重要的进展:

相比MLX-LM,推理速度提升1.35倍 预填充速度提升1.23倍

能在Perplexity内直接选择混合计算模式实在太棒了,而Lily的开源更是锦上添花。

任何人都能利用这项技术,操作系统可以在此基础上实现更大的突破。

Perplexity (@perplexity_ai): 今天我们开源了Lily——这是为Perplexity Computer中的混合计算构建的本地推理引擎。

Lily专为苹果芯片上的Qwen3.6-35B-A3B模型优化,确保设备端计算不会成为Computer任务的性能瓶颈。

了解更多:

相似文章