热还是不热?
摘要
作者正在为其DGX堆栈添加主动冷却,以管理长时间负载下的热量,并计划分享与comphy和DeepSeek flash相关的结果。
还有其他人给他们的DGX堆栈添加主动冷却吗?我发现我的设备在长时间负载下变得相当热。到目前为止,这在这方面帮助很大。我将在本周末添加一些与comphy和DeepSeek flash相关的统计数据。我没有创建原始设计,而是将它们合并在一起,并添加了一些调整,我可以在另一篇文章中解释。当我回到笔记本电脑时,我会分享属性和其他所有内容。我只是等不及要分享结果了。
相似文章
找到了冷却 DGX 的方法
有用户报告称,在运行 Qwen3.5-122b 模型且 GPU 高负载的情况下,成功使用自来水为 DGX 服务器降温,并维持了安全的温度水平。
Deepseek V4 flash 在 DGX Spark 上的性能
一位 Reddit 用户分享了在双华硕 GX10 DGX Spark 配置上运行 DeepSeek V4 Flash 的经验,详细介绍了性能指标、配置和功耗,并提供了不同上下文长度下的吞吐量基准测试结果。
DGX Sparks与新模型:我的测试与结果
本文介绍了在NVIDIA DGX Sparks硬件上测试DeepSeek V4 Flash和Qwen3.8等AI模型的结果,详细说明了性能指标、上下文长度、基准分数以及操作见解。
@MichaelGannotti: https://x.com/MichaelGannotti/status/2084186867000279436
对NVIDIA DGX Spark上的DeepSeek V4 Flash进行了14.7小时的浸泡测试,共971个请求,结果表明零崩溃或错误,但由于热节流,吞吐量下降了28%,而TTFT和推测接受率保持稳定。
@RayFernando1337: 让他发挥。现在拥有两台DGX Sparks真是太有趣了。
一位Twitter用户讨论拥有两台NVIDIA DGX Sparks系统,而另一位用户报告通过模型更新到DFlash2-7后,token吞吐量达到每秒67个。