dgx-spark

标签

Cards List
#dgx-spark

DGX Spark 怎么回事?一周内价格上涨 $2000?

Reddit r/LocalLLaMA ↗ · 昨天

有买家反映 NVIDIA DGX Spark 难以买到,价格似乎在一周内上涨了约 $2,000,当地 Micro Center 的库存一夜之间售罄,引发关于供货分配的疑问。

0 人收藏 0 人点赞
#dgx-spark

@no_stp_on_snek:同样的两块 GB10。GLM-5.3-Flash,两套技术栈。各进行一次流式调用,温度 0.2,384 tokens,提示词约 3.7k tokens…

X AI KOLs Timeline ↗ · 昨天 缓存

两套社区推理栈在同一对 NVIDIA DGX Spark 上运行 320B GLM-5.3-Flash 的对比测试,比较 Entrpi 的 EXL3 方案与使用 DFlash2 草稿模型的 TensorFold 在文本、代码及预填充负载下的表现。

0 人收藏 0 人点赞
#dgx-spark

您的DGX Spark需要额外内存吗?

Reddit r/LocalLLaMA ↗ · 3天前

此仓库帮助DGX Spark用户利用备用GPU释放内存,以提升上下文长度或量化质量,通过远程推理卸载草稿模型,并使用vllm修改版。

0 人收藏 0 人点赞
#dgx-spark

@alexocheema: 我买第一台 DGX Spark 时希望有的手册

X AI KOLs Timeline ↗ · 6天前 缓存

一条推文,分享针对 NVIDIA DGX Spark AI 计算系统新用户的个人手册指南。

0 人收藏 0 人点赞
#dgx-spark

@TheAhmadOsman: Mac Studio M5 Ultra 对比 2x DGX Spark 在 DeepSeek V4 Flash 上的表现 - DGX Sparks: 预填充快 2.41 倍(计算密集型) - Mac S…

X AI KOLs Timeline ↗ · 2026-09-24 缓存

本文比较了 Apple 的 Mac Studio M5 Ultra 和两台 NVIDIA DGX Spark 在运行 DeepSeek V4 Flash 模型时的推理性能,显示 DGX Sparks 在预填充方面更快,而 Mac Studio 在生成方面略快。

0 人收藏 0 人点赞
#dgx-spark

@KyleHelseth: Nvidia平台的DGX Spark首次售罄

X AI KOLs Following ↗ · 2026-09-20 缓存

Nvidia的DGX Spark在平台上首次缺货,零售价上涨,这表明AI硬件需求强劲,并可能带来经济影响。

0 人收藏 0 人点赞
#dgx-spark

昨天用一台NVIDIA DGX Spark,搭配Qwen3.8-Flash-Next(NVFP4,262K上下文)搭建的项目

Reddit r/LocalLLaMA ↗ · 2026-09-18

一位开发者在单台NVIDIA DGX Spark上,使用Qwen3.8-Flash-Next模型在8小时内构建了一个项目,生成了约1万行代码,并消耗了80万token。

0 人收藏 0 人点赞
#dgx-spark

@heyshrutimishra: 我的AI代理每周为我节省30-35小时。我经营一个SaaS和一个品牌代理。我没有大团队。我让Hermes运行……

X AI KOLs Following ↗ · 2026-09-14 缓存

作者分享了一个名为Hermes的AI代理如何在DGX Spark上运行,自动化业务任务如内容管理和客户咨询,每周节省30-35小时,并认为代理市场正处于类似早期移动互联网的关键时刻。

0 人收藏 0 人点赞
#dgx-spark

说服我不要购买第三个Spark

Reddit r/LocalLLaMA ↗ · 2026-09-13

一位用户在论坛上询问,2倍的DGX Spark集群能否运行DeepSeek 4.1 Flash模型,或者是否需要更多的Spark,并寻求社区意见。

0 人收藏 0 人点赞
#dgx-spark

@ViC305: 18小时后:DeepSeek-V4.1-Flash 现已量化至 4.75 bpw EXL3,适用于 4× DGX Spark TP4 目标。权重已完…

X AI KOLs Following ↗ · 2026-09-11 缓存

DeepSeek-V4.1-Flash 已量化至 4.75 bpw EXL3,以便部署在 4× DGX Spark 上,优化内存使用并实现高效本地推理,同时有计划进行验证和进一步优化。

0 人收藏 0 人点赞
#dgx-spark

@QuixiAI: DGX Spark 的 NVIDIA 开源内核驱动迎来两项修复——进程退出时,释放的 GPU 内存现已归还操作系统……

X AI KOLs Timeline ↗ · 2026-09-05

DGX Spark 的 NVIDIA 开源内核驱动迎来两项修复:进程退出时释放的 GPU 内存将归还操作系统,同时为 GPU 访问系统内存产生的缺页异常启用大页机制,首次访问带宽从 0.4 提升至 19.6 GiB/s。

0 人收藏 0 人点赞
#dgx-spark

@sgl_project: 我们刚刚为 DeepSeek-V4-Flash-Vision 和 DeepSeek-V4-Flash-0731 在 2x DGX Spark 上添加了指南。 https://docs.sglang.io/coo…

X AI KOLs Timeline ↗ · 2026-09-03 缓存

SGLang 已经为 DeepSeek-V4-Flash-Vision 和 DeepSeek-V4-Flash-0731 模型在 2x DGX Spark 硬件上添加了部署指南,支持多种配置和优化。

0 人收藏 0 人点赞
#dgx-spark

@ViC305: 我做到了!! DeepSeek-V4-Flash-Vision EXL3 MixedK 现在在单个 DGX 上同时运行 VISION + DSpark 推测解码…

X AI KOLs Timeline ↗ · 2026-09-03 缓存

用户 @ViC305 成功在单个 DGX Spark 上运行 DeepSeek-V4-Flash-Vision,结合 EXL3 MixedK 和 DSpark 推测解码,提升了性能并解决了多模态 AI 部署的技术问题。

0 人收藏 0 人点赞
#dgx-spark

@QuixiAI:这确实是个真bug,DGX Spark应该在CUDA一发布*立即*就获取最新版本 @nvidia

X AI KOLs Following ↗ · 2026-09-02 缓存

DGX Spark中发现了一个bug,作者敦促NVIDIA确保它能无延迟地获取最新的CUDA更新。

0 人收藏 0 人点赞
#dgx-spark

@QuixiAI:我终于拿到了一个 DGX Spark。首先注意到的是——他们让安装最新的 CUDA 变得很困难。我可能需要安装原版的…

X AI KOLs Timeline ↗ · 2026-09-02 缓存

用户 @QuixiAI 报告在安装最新的 CUDA 工具包到其 NVIDIA DGX Spark 时遇到困难,建议可能需要安装原版 Ubuntu 来解决此问题。

0 人收藏 0 人点赞
#dgx-spark

DGX Spark 即将涨价?Asus Ascent GX10 今天从 $3999 涨至 $5999...

Reddit r/LocalLLaMA ↗ · 2026-09-01

Asus Ascent GX10 桌面 AI 超级计算机价格大幅上涨,引发猜测 DGX Spark 系统可能也很快会涨价。

0 人收藏 0 人点赞
#dgx-spark

Qwen3.8-Flash-Next NVFP4 在双DGX Spark上的配置:解码速度50t/s,预填充速度2,900t/s

Reddit r/LocalLLaMA ↗ · 2026-08-30

用户分享了在双DGX Spark硬件上部署Qwen3.8-Flash-Next模型的优化配置,通过技术补丁和设置细节,实现了高达50t/s的解码速度和2,900t/s的预填充速度。

0 人收藏 0 人点赞
#dgx-spark

@shantanugoel: 我通过两天对众多超参数和补丁进行系统搜索后得到的配置

X AI KOLs Following ↗ · 2026-08-28 缓存

Shantanu Goel 分享了一个优化 Qwen 3.8 Flash Next 在单个 DGX Spark 上的配置方案,已针对实际任务进行测试,并计划进一步进行基准测试。

0 人收藏 0 人点赞
#dgx-spark

@RayFernando1337: 哇,仓库已上线!

X AI KOLs Following ↗ · 2026-08-28 缓存

宣布GLM 5.3 FLASH模型的仓库已上线,初步基准测试显示在DGX SPARK硬件上每秒处理59个令牌,并承诺将有更多更新。

0 人收藏 0 人点赞
#dgx-spark

CNBC Television: Nvidia与Perplexity AI在DGX Spark上合作本地运行。

Reddit r/LocalLLaMA ↗ · 2026-08-25 缓存

NVIDIA和Perplexity AI已合作通过DGX Spark设备将AI处理引入本地桌面,专注于降低成本和数据隐私,对于高级推理任务则卸载到云端。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈