rtx-5090

标签

Cards List
#rtx-5090

@rohanpaul_ai: 精美的视觉展示,有人在本地运行 Qwen 3.8 27B,使用 RTX 5090 32 GB 显存系统,速度达到 115 tokens/秒 注意,Qw…

X AI KOLs Timeline · 21小时前 缓存

推文重点介绍了在 RTX 5090 系统上本地运行 Qwen 3.8 27B 模型,配备 32GB 显存,达到 115 tokens/秒的速度,并指出官方 BF16 检查点大小为 55.6GB。

0 人收藏 0 人点赞
#rtx-5090

@sgl_project:我们在 Qwen3.8-27B 手册中更新了 RTX 5090 / RTX Pro 6000 的配置指南 http://docs.sglang.io/cookboo…

X AI KOLs Timeline · 23小时前 缓存

SGLang 已更新其在 RTX 5090 和 RTX Pro 6000 硬件上部署 Qwen3.8-27B 模型的配置指南,为不同配置添加了变体,并提供了调优选项。

0 人收藏 0 人点赞
#rtx-5090

我们对 DeepSeek V4 0731 进行了量化,并在 8× RTX 5090 上与其他流行的量化版本进行了基准测试

Reddit r/LocalLLaMA · 6天前

作者对 DeepSeek V4 0731 进行量化,修复了会导致基线偏差的 FP8 降转换问题,并在 8× RTX 5090 上对 38 个量化文件进行基准测试,展示了依赖 GPU 的结果和基于文件大小的比较。

0 人收藏 0 人点赞
#rtx-5090

可达 253 t/s - unsloth/Muse Glimmer 30B UD-Q5_K_M 在 5090 上

Reddit r/LocalLLaMA · 2026-08-10

在 RTX 5090 上对 unsloth 的 Muse Glimmer 30B 进行基准测试,采用推测解码,使用 DFlash 草稿模型和基于 GPU 的 argmax PR,最高可达 253 t/s,不过该 PR 仍是草稿状态。

0 人收藏 0 人点赞
#rtx-5090

RTX 5090 96GB现身阿里巴巴?

Reddit r/LocalLLaMA · 2026-08-09

一款据称配备96GB显存的RTX 5090在阿里巴巴上现身,暗示英伟达可能会推出新的GPU版本。

0 人收藏 0 人点赞
#rtx-5090

RTX 5090 用户打造开源工具:检测到 12VHPWR 线缆功耗过高即自动关机,但仅限特定 GPU 使用

Reddit r/LocalLLaMA · 2026-08-07 缓存

一位 Reddit 用户构建了一款名为 12vhpwr-guard 的开源工具,可监控 ASUS Astral RTX 5080/5090 显卡的每针电流,如果任何针脚电流超过 9.5A 并持续 15 秒,就会关闭电脑,以防 12VHPWR 接口熔化。

0 人收藏 0 人点赞
#rtx-5090

[Deepseek-V4-Flash-0731] 在单张RTX5090 + DDR5桌面配置下,通过VLLM CPU/内存卸载实现完整1M上下文,~800 tps预填充 & 15+ tps解码 [智能体编码]

Reddit r/LocalLLaMA · 2026-08-04

关于在单张 RTX 5090 + 256GB DDR5 台式机上使用 vLLM 配合 CPU/内存卸载运行 DeepSeek-V4-Flash-0731 完整 100 万 token 上下文的技术报告,实现了约 800 tokens/秒的预填充速度和约 15 tokens/秒的解码速度。

0 人收藏 0 人点赞
#rtx-5090

@dee_hw: Qwen3.8-27B 即将发布。我们开源了我们的 2x RTX 5090 构建,让你可以在本地托管:本地部署、私有、无速率限制…

X AI KOLs Timeline · 2026-08-03 缓存

Autonomous AI 开源了一款由 2x 或 4x NVIDIA RTX 5090 驱动的个人 AI 计算机构建方案,实现完全本地、私有的 AI 托管,无需 API 成本或速率限制。

0 人收藏 0 人点赞
#rtx-5090

Best Buy 以高于 RTX 5090 MSRP 的价格销售 RTX 5080

The Verge · 2026-07-30 缓存

Best Buy 已将 Asus ROG Astral RTX 5080 OC 的价格上调至 2,099 美元,超过了 RTX 5090 的 MSRP,反映了持续的组件短缺和 GPU 价格上涨。

0 人收藏 0 人点赞
#rtx-5090

我在5090上实现了代码审查功能,在Martian基准上F1得分为22.7

Reddit r/AI_Agents · 2026-07-22

一位开发者使用开源权重模型在消费级RTX 5090 GPU上创建了一个代码审查工具,在Martian代码审查基准上取得了F1 22.7的成绩,目前正在考虑将其商业化或开源。

0 人收藏 0 人点赞
#rtx-5090

I benchmarked Unsloth's Qwen3.6-27B NVFP4 on 1x/2x 5090s. MTP is great until it really isn't.

Reddit r/LocalLLaMA · 2026-07-21

详细基准测试:Unsloth的Qwen3.6-27B NVFP4模型在RTX 5090 GPU上的表现,显示MTP(多令牌预测)在短上下文的单次请求中能显著加速,但在批量并发或长上下文场景下则会带来不利影响。

0 人收藏 0 人点赞
#rtx-5090

@kyzoroX: 中国工厂批量购买RTX 5090,拆下芯片,重新组装成128GB服务器显卡。粗略…

X AI KOLs Timeline · 2026-07-16 缓存

中国工厂将消费级RTX 5090 GPU改装成128GB服务器显卡,以规避专用AI芯片的出口管制,形成了官方企业级产品的灰色市场竞争对手。

0 人收藏 0 人点赞
#rtx-5090

如果你使用 Open Code 或其他代理程序,但没有并行使用代理,那么你会损失大量的 t/s。基准测试:RTX5090,通过 LM Studio 加载 Qwen3.6 35B,并行任务数设为 8

Reddit r/LocalLLaMA · 2026-07-12

基准测试表明,在 RTX 5090 上使用 LM Studio 并行运行 4-5 个代理可最大化吞吐量,而更多代理会因显存和计算分割导致收益递减。

0 人收藏 0 人点赞
#rtx-5090

Qwen3.6 27B 在 RTX 5090 上,调整 MTP/缓存设置后的 6.4k 采样 token/s 分布

Reddit r/LocalLLaMA · 2026-07-04

在 RTX 5090 上运行 Qwen3.6 27B,调整 MTP 和缓存设置后达到每秒 6.4k 个 token,展示了推理优化技术。

0 人收藏 0 人点赞
#rtx-5090

RTX5090, gemma-4-31B-it-Q6_K.gguf。上下文:之前 - 35k,之后 - 80k!

Reddit r/LocalLLaMA · 2026-07-04

在RTX 5090上运行量化后的Gemma-4-31B模型,上下文长度从35k增加到80k,展示了显著的性能提升。

0 人收藏 0 人点赞
#rtx-5090

Deepseek V4 Flash 在 RTX 5090 MoE 上运行

Reddit r/LocalLLaMA · 2026-07-03

用户分享了在 RTX 5090 上使用 llama.cpp 的一个分支运行 DeepSeek-V4-Flash (Q2_K) 的优化基准测试结果,实现了 21.3 token/秒的生成速度和 100 万上下文大小。

0 人收藏 0 人点赞
#rtx-5090

@TheAhmadOsman: 预测

X AI KOLs Timeline · 2026-07-03 缓存

Ahmad Osman 预测,在18个月内,像 RTX 5090 这样的GPU将能够承载相当于 GLM 5.2 的智能。

0 人收藏 0 人点赞
#rtx-5090

@Xudong07452910: Hacker News 上有一篇评论区火了的文章:Qwen 3.6 27B 是本地开发的理想选择。 核心发现是:密集参数模型、原生支持 256k 上下文,在 MacBook Max M5 上跑 Q8_0 量化版能达到 30 tokens/…

X AI KOLs Timeline · 2026-07-03 缓存

Qwen 3.6 27B is a dense 27B model that achieves impressive performance on local hardware with 256k context, running at 30 tokens/s on MacBook Max M5 and 50 tokens/s on RTX 5090, and is considered by some as the first local model with true general intelligence.

0 人收藏 0 人点赞
#rtx-5090

@RayFernando1337: https://x.com/RayFernando1337/status/2070621713952579990

X AI KOLs Following · 2026-06-26 缓存

关于是在本地运行AI模型还是通过API运行的详细分析,涵盖了RTX 5090、RTX PRO 6000和DGX Spark等硬件选项,重点讨论了内存与带宽的权衡、成本考虑以及隐私需求。

0 人收藏 0 人点赞
#rtx-5090

RTX 5090 MSI,仅推理或训练时功耗475-500W。请确保不要弯折线缆!

Reddit r/LocalLLaMA · 2026-06-20

MSI的RTX 5090 GPU在推理或训练时功耗为475-500W,并附有关于线缆弯折的警告。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈