搭建16xGB10(DGX Spark)集群

Reddit r/LocalLLaMA 新闻

摘要

用户正在搭建一个16节点的DGX Spark集群,以便本地运行前沿开放模型,并讨论200与100 Gbit/s之间的网络权衡。

准备这个是为了能够在本地运行前沿级别的开放模型。Deepseek v4 pro、Kimi K3,以及未来的像GLM 5.5和Minimax M4。16台Asus GX10通过mikrotik crs804-4ddq连接,使用4条400到100gbit的分支线缆。最有可能我会在8节点集群上分别运行2个模型,但我也希望需要时能够运行2T+的模型,以便在家跑AGI :))。https://x.com/i/status/2083568340870570208 附注:我需要一个更大的交换机。从200降到100gbit对token生成影响不大,只有2%的差异,但会把prefill速度减慢到-20%。
查看原文

相似文章

DGX Spark 智能体使用数据

Reddit r/LocalLLaMA

一位用户分享了在 NVIDIA DGX Spark 上使用 vLLM 运行 Qwen3.6 模型的基准测试结果和配置,重点关注包含并发请求和工具调用的智能体工作负载。