@shaneparrish: https://x.com/shaneparrish/status/2075226155548807210

X AI KOLs Following 模型

摘要

演示了在MacBook Pro上利用BBQ-FP4量化同时运行两个80B Qwen模型,声称性能无损且速度很快。

👀
查看原文
查看缓存全文

缓存时间: 2026/07/10 08:09

👀

Rob Imbeault (@RobImbeault): 两台80B Qwen BBQ-FP4模型同时在MacBook Pro上运行,功能无损且速度飞快!

团队正在大显身手!

相似文章

我在 MacBook Air M5 上对 21 款本地大模型进行了代码质量与速度的性能评测

Reddit r/LocalLLaMA

一位开发者在 MacBook Air M5 上使用 HumanEval+ 对 21 款本地大模型进行了基准测试,发现 Qwen 3.6 35B-A3B (MoE) 以 89.6% 的得分和 16.9 tok/s 的速度位居榜首,而 Qwen 2.5 Coder 7B 仅需 4.5 GB 内存即可达到 84.2% 的性能,拥有最佳的内存性价比。值得注意的是,Gemma 4 系列的表现远低于预期(31B 版本仅得 31.1%),这可能是受 Q4_K_M 量化策略的影响。