@Youssofal_: 感谢 Kate 对 MTPLX 的全面评测。她测试了多种不同的 MLX 运行时,并得出结论 MTP…

X AI KOLs Timeline 工具

摘要

nicekate 在 Mac 上测试了多种 MLX 运行时以运行 Qwen3.6-27B,并得出结论 MTPLX 是最快的,在 4bit 量化下达到 43 tok/s。

感谢 Kate 对 MTPLX 的全面评测。 她测试了多种不同的 MLX 运行时,并得出结论 MTPLX 是最快的! 最大的发现是我不小心从模型中移除了视觉头(vision head)。我很快就会恢复它。 我期待在周末为 MTPLX 带来重大升级。
查看原文
查看缓存全文

缓存时间: 2026/05/16 19:21

感谢 Kate 对 MTPLX 的详尽评测。

她测试了多个不同的 MLX 运行时,得出结论:MTPLX 是最快的!

最大的发现是,我不小心从模型中剥离了视觉头部,很快就会把它恢复。

我期待周末为 MTPLX 带来重大升级。

nicekate (@nicekate8888):
最近二十天我都在折腾一件事——怎么让 Qwen3.6-27B 在我的 Mac 上跑得又快又好。

一开始我用 Unsloth Q5,18 tok/s,风扇呼啦呼啦响。

后来换成 MLX 6bit + DFlash,提到 22 tok/s,还是不够快。

直到我遇到了 MTPLX 4bit,43 tok/s,质量不错。

完整视频:🧵

相似文章