@MichaelGannotti: 在2个@NVIDIAAI DGX Sparks上工作
摘要
DeepSeek-V4.1-Flash AI模型被用于NVIDIA DGX Spark单元上,以自动执行内核工作、读取项目文档并开启pull request,展示了软件开发中的真实AI自动化。
查看缓存全文
缓存时间: 2026/09/15 17:47
在2台@NVIDIAAI DGX Sparks上进行运算工作
Tom Turney (@no_stp_on_snek):
在2台Sparks上运行DeepSeek-V4.1-Flash。高思考强度,张量并行=2。5500万token。这是实际的内核级工作,并非演示。它读取了说明文档和产品需求文档,对比了A方案与B方案,确认了优化效果,随后直接提交了代码合并请求。
我亲眼见证了代码发布过程,而我本人并未参与编写。
从表面看修复逻辑:因果注意力机制呈现“三角形“结构。而
相似文章
模型训练完成后,Nemo 已将 @deepseek_ai V4 Flash 在我的 2 节点 @NVIDIAAI DGX 集群上重新上线,我能够...
Michael Gannotti 分享道,在完成模型训练后,他已将 DeepSeek 的 V4 Flash AI 模型在其 NVIDIA DGX 集群上重新上线,这使他能够恢复本地推理以运行智能体。
DGX Sparks与新模型:我的测试与结果
本文介绍了在NVIDIA DGX Sparks硬件上测试DeepSeek V4 Flash和Qwen3.8等AI模型的结果,详细说明了性能指标、上下文长度、基准分数以及操作见解。
@no_stp_on_snek: 单个 Spark 能做的事情依然非常了不起。感谢 @NVIDIAAI
一位用户分享说,他们使用 antirez 的 DwarfStar-4 配置,在 DGX Spark 上复现了 DeepSeek-V4-Flash-0731 的运行,证实了该设备在单机上的出色性能。
@MichaelGannotti: https://x.com/MichaelGannotti/status/2074486390432149979
对NVIDIA的Nemotron-3 Mamba-Transformer混合模型在DGX Spark硬件上的全栈评估,包括架构分析、量化(NVFP4)、基准测试结果,以及开源测试套件smf-bench的介绍。
@ViC305: 我做到了!! DeepSeek-V4-Flash-Vision EXL3 MixedK 现在在单个 DGX 上同时运行 VISION + DSpark 推测解码…
用户 @ViC305 成功在单个 DGX Spark 上运行 DeepSeek-V4-Flash-Vision,结合 EXL3 MixedK 和 DSpark 推测解码,提升了性能并解决了多模态 AI 部署的技术问题。