dual-gpu

标签

Cards List
#dual-gpu

Puget Systems 的一份非常令人困惑的报告

Reddit r/LocalLLaMA · 2026-09-01 缓存

本文评估了双 AMD Radeon AI PRO R9700 GPU 的 AI 推理性能,并将其与 Intel Arc Pro B70 和 NVIDIA RTX 5090 进行比较,突出了成本效益和软件挑战。

0 人收藏 0 人点赞
#dual-gpu

双3090配置:Qwen 3.6 27B 上从 400 pp tokens/s 提升到 1600 pp tokens/s... 但 tps 略降。

Reddit r/LocalLLaMA · 2026-08-06

使用双 RTX 3090 配置的用户发现,llama.cpp 的 `--split-mode tensor` 会在 CPU 上运行提示处理(约 400 t/s),而切换到 `--split-mode layer` 则可解锁 GPU 提示处理,速度超过 1600 t/s,且 token 生成速度仅略有下降。

0 人收藏 0 人点赞
#dual-gpu

今日学到:为什么我的双5060 Ti配置卡在50%使用率上不去——不是它坏了。

Reddit r/LocalLLaMA · 2026-07-22

探讨双RTX 5060 Ti GPU在运行Qwen 27B等大型LLM时利用率仅达50%左右的原因:内存带宽是瓶颈,逐层拆分导致空闲时间,这更像是接力赛而非并行计算。

0 人收藏 0 人点赞
#dual-gpu

双GPU下流水线与张量并行的llama.cpp中测量PCIe传输

Reddit r/LocalLLaMA · 2026-07-11

在双GPU下使用流水线和张量并行运行llama.cpp时的PCIe传输性能分析。

0 人收藏 0 人点赞
#dual-gpu

2x RX 9060 XT 16GB,值得吗?

Reddit r/LocalLLaMA · 2026-06-27

讨论使用两张Radeon RX 9060 XT 16GB显卡组成CrossFire配置的潜在价值,可能权衡性能与成本。

0 人收藏 0 人点赞
#dual-gpu

ROCm vs Vulkan vs vLLM 在双R9700上的对比

Reddit r/LocalLLaMA · 2026-06-21

对运行在双AMD Radeon 9700 GPU上的AI推理框架ROCm、Vulkan和vLLM进行比较,可能是在对大型语言模型的性能进行基准测试。

0 人收藏 0 人点赞
#dual-gpu

比较 llama.cpp 行/张量分割与 ik_llama 图分割的双GPU推理速度

Reddit r/LocalLLaMA · 2026-06-12

一位用户使用llama.cpp(行/张量切分)和ik_llama(图切分)在两张RTX 3080 20GB上对双GPU推理速度进行了基准测试,使用Qwen3.6-27B GGUF模型,比较了token生成和提示处理速度。

0 人收藏 0 人点赞
#dual-gpu

真不敢相信我成功了!双GPU - 48GB显存 llama-cpp服务器 - R7900 + 7800XT

Reddit r/LocalLLaMA · 2026-05-22

一位用户成功在Kubuntu 24.04上通过Docker中的Vulkan设置了一个双GPU llama-cpp服务器,使用AMD Radeon PRO和7800 XT,拥有48GB显存。

0 人收藏 0 人点赞
#dual-gpu

双GPU llama.cpp加速

Reddit r/LocalLLaMA · 2026-05-17

llama.cpp的一个分支修复了量化KV缓存中的--split-mode tensor问题,在双GPU配置上实现高达40%的速度提升,且无质量损失。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈