@MichaelGannotti: 在2个@NVIDIAAI DGX Sparks上工作

X AI KOLs Following 新闻

摘要

DeepSeek-V4.1-Flash AI模型被用于NVIDIA DGX Spark单元上,以自动执行内核工作、读取项目文档并开启pull request,展示了软件开发中的真实AI自动化。

在2个@NVIDIAAI DGX Sparks上工作
查看原文
查看缓存全文

缓存时间: 2026/09/15 17:47

在2台@NVIDIAAI DGX Sparks上进行运算工作

Tom Turney (@no_stp_on_snek):
在2台Sparks上运行DeepSeek-V4.1-Flash。高思考强度,张量并行=2。5500万token。这是实际的内核级工作,并非演示。

它读取了说明文档和产品需求文档,对比了A方案与B方案,确认了优化效果,随后直接提交了代码合并请求。

我亲眼见证了代码发布过程,而我本人并未参与编写。

从表面看修复逻辑:因果注意力机制呈现“三角形“结构。而

相似文章

DGX Sparks与新模型:我的测试与结果

Reddit r/LocalLLaMA

本文介绍了在NVIDIA DGX Sparks硬件上测试DeepSeek V4 Flash和Qwen3.8等AI模型的结果,详细说明了性能指标、上下文长度、基准分数以及操作见解。