4 x DGX Sparks 与 AMD Epyc 9xx5 系统对比

Reddit r/LocalLLaMA 新闻

摘要

本文讨论了 NVIDIA DGX Spark 集群与 AMD Epyc 服务器在 AI 工作负载上的比较,重点关注成本、内存带宽以及 FP4 支持和张量并行等功能。

我看到很多人购买 DGX Sparks,并将它们组建成集群来运行大型模型。难道不将 $16,000 投资到一个拥有 768GB 甚至 384GB 6000MHz DDR5 内存的 AMD Epyc 服务器上更好吗?比如配备 2x3090s 或 5080s,而不是使用 4 个拥有 512GB 内存的 DGX Sparks?Epyc 的理论带宽约为 576GB/s,DGX Spark 的大约为 273GB/s。快速检查显示,两个系统都大约价值 $16,000。请帮助我理解这个逻辑,除了省电之外,拥有 DGX 集群相比 Epyc 系统有什么好处吗? 编辑1:拥有 768GB DDR5 6000MHz 内存的 Epyc 系统大约需要 $30,000。 编辑2:要匹配 Epyc 的 768GB,我们需要 6 个 DGX Sparks,按当前涨价后的价格,大约也是 $30,000。 编辑3:DGX Sparks 集群的主要优势是支持 FP4 和 2、4、8、16... 单元的张量并行。因此,DGX 集群比 Epyc 系统更快。
查看原文

相似文章

“全火花”集群:从16台升级到36台DGX Spark

Reddit r/LocalLLaMA

本文详细介绍了将个人家庭实验室从16台升级到36台NVIDIA DGX Spark设备,形成一个集群用于同时执行AI推理任务,如模型服务和媒体生成。选择它是因为其成本效益和数据主权。

Nvidia DGX Spark 作为日常使用的电脑

Hacker News Top

作者评价了 NVIDIA DGX Spark 作为一款功能强大的通用计算机,尽管它主要是一款人工智能开发设备,但其性能、能效以及能够运行《孤岛危机》等游戏的能力都备受称赞。

DGX Spark 智能体使用数据

Reddit r/LocalLLaMA

一位用户分享了在 NVIDIA DGX Spark 上使用 vLLM 运行 Qwen3.6 模型的基准测试结果和配置,重点关注包含并发请求和工具调用的智能体工作负载。