@AlexJonesax:在M5Max上启用MTP和oMLX推理,Qwen3.6-27b飞速运行

X AI KOLs Timeline 新闻

摘要

社区报告称,通过oMLX优化,Qwen3.6-27b模型在M5Max硬件上实现了极高的推理性能。

启用MTP和oMLX推理后,Qwen3.6-27b在M5Max上极速运行。https://t.co/pc52oqga78
查看原文
查看缓存全文

缓存时间: 2026/05/11 12:43

开启 MTP 并搭配 oMLX 推理,Qwen3.6-27b 在 M5Max 上跑得飞快。https://t.co/pc52oqga78

相似文章

在Strix Halo上运行的Qwen3.8-27B Q8_0令人印象深刻

Reddit r/LocalLLaMA

作者在配备Ryzen AI Max+ 395的ROG Flow Z13上测试了Qwen3.8-27B Q8_0 AI模型,使用Lemonade Server和llama.cpp进行推测解码,实现了令人印象深刻的本地推理性能,生成了一个飞行模拟器。