M5 vs DGX Spark vs Strix Halo vs RTX 6000
摘要
一位用户在过去3天内对M5 Mac、DGX Spark、Strix Halo和RTX 6000进行了AI工作负载的基准测试,并将结果发布到GitHub。M5在内存带宽和令牌生成方面优于DGX Spark,而MacBook的散热表现出奇地好,但噪音较大。
嘿,各位,简单说说。网上关于新款M5 Mac、DGX Spark、Strix Halo以及独立GPU等有很多争论。所以我把它们都放在一个电源和散热良好的环境中,在过去3天里并行运行标准测试,并将所有结果发布到一个仓库中。很多结果并不出人意料,只要想想核心数据和基本原理就知道了。RTX6000的内存带宽约为1,800 GB/s,而M5约为600 GB/s,Spark和Strix约为256 GB/s。每个硬件的每秒令牌生成数也很好地遵循了这种数学关系和曲线。从价格来看,假设你对生态系统没有偏好,顶配M5确实很靠谱,且明显优于DGX Spark。同样,这也不意外,看看内存带宽速度就知道了(M5在统一内存总量相同的情况下速度是2倍以上)。第二点值得注意的也不出人意料,但EVO X2在长时间运行时的散热存在问题。MacBook的散热表现反而最让我惊讶,它坚持了几天,温度稳定在80°C左右。不过我得说,当它满载时听起来就像一台普通游戏本。有人说它们‘安静’,这其实有点宣传成分。当你让M5 MacBook Pro全力运行本地AI时,它就像其他所有试图跑本地AI的笔记本一样,变成了吹风机。它做工扎实如航母,就本身定位而言性能很棒,但运行时你绝对知道它在工作,哈哈。我现在正在切换后端,并为Mac上的MLX、Strix Halo上的不同托管后端等添加数据,以了解它们对性能和输出的影响。RTX6000和RTX5090不是同一款卡,免得纠错党找我麻烦,但两者之间有很多相似之处,这些数据或许对纠结于5090 PC和其他机器的用户有用。无论如何,仓库附上,希望这些原始数据和数字能对未来的讨论和争论有所帮助:https://github.com/Light-Heart-Labs/MMBT-Messy-Model-Bench-Tests/tree/main/hardware-tests
相似文章
1块RTX Pro 6000还是2台DGX Spark
针对AI计算任务,对单块RTX Pro 6000 GPU与两台DGX Spark系统进行比较。
@jun_song: 最佳中端本地LLM硬件:DGX Spark 对比 Mac Studio M5 Max 128GB(即将推出)价格:4700美元(二手或OEM更便宜)…
DGX Spark与Mac Studio M5 Max在本地运行LLM的对比,重点比较了解码速度、预填充性能、内存、功耗和成本。Mac在解码带宽上胜出,但DGX在预填充方面更快并支持批处理。
Strix Halo桌面试图与DGX Spark竞争
AMD推出Ryzen AI Halo开发者平台,这是一款售价3999美元的迷你PC,配备128GB统一内存并支持Windows 11,与Nvidia的DGX Spark在本地AI工作负载领域竞争。
@LyalinDotCom: https://x.com/LyalinDotCom/status/2059023609536839684
比较在DGX Spark和MacBook Pro M5上运行Gemma 4的情况,作者对收到DGX Spark表示感谢。
在Strix Halo、RTX 3090和RTX 5070上运行相同模型,只为获得自己的数据
作者在Strix Halo、RTX 3090和RTX 5070上使用了多个后端,进行了55次推理基准测试。结果揭示,显存带宽主导解码速度,RTX 5070在小模型上击败RTX 3090,而推理模型因隐藏的推理内容看起来慢约5倍。