pcie

标签

Cards List
#pcie

PSA:请勿使用 Intel 消费级平台进行多 GPU 配置

Reddit r/LocalLLaMA · 2026-07-25

测试表明,搭载Arrow Lake CPU的Intel消费级平台(如Z890)存在硬件/固件限制,阻碍了多GPU之间进行正常的PCIe点对点(P2P)通信。虽然通道数量充足,但这些平台仍不适合多GPU AI工作负载。

0 人收藏 0 人点赞
#pcie

@superalesha: https://x.com/superalesha/status/2077437741915312221

X AI KOLs Timeline · 2026-07-15 缓存

作者分享了在四张RTX 3090本地设备上六个月的测量数据,结果表明对于适配较少显卡的模型,数据并行通常优于张量并行,吞吐量差异可达3.4倍。

0 人收藏 0 人点赞
#pcie

双GPU下流水线与张量并行的llama.cpp中测量PCIe传输

Reddit r/LocalLLaMA · 2026-07-11

在双GPU下使用流水线和张量并行运行llama.cpp时的PCIe传输性能分析。

0 人收藏 0 人点赞
#pcie

对于双GPU,在PCIe 5.0 x8/x4与x8/x8模式下运行时,推理速度会有很大影响吗?

Reddit r/LocalLLaMA · 2026-06-26

一位用户询问在PCIe 5.0 x8/x4与x8/x8模式下运行双GPU是否会对LLM推理速度产生显著影响。

0 人收藏 0 人点赞
#pcie

我意外地用一条隐藏的PCIe 2.0 x4插槽削弱了4x RTX 3090 LLM设备的性能,修复后使Mistral 128B的性能翻倍。

Reddit r/LocalLLaMA · 2026-06-04

用户发现,Threadripper 工作站主板上一处隐藏的 PCIe 2.0 x4 电气限制导致四块 RTX 3090 中的一块性能受限,从而影响了多 GPU 大语言模型推理性能。通过调整插槽布局并切换至张量分裂模式,Mistral 128B 的吞吐量从约 11 tok/s 翻倍至约 24.7 tok/s。

0 人收藏 0 人点赞
#pcie

Project Blackwell:最终会成功——让RTX Pro 6000在Dell R730上以650K上下文运行

Reddit r/LocalLLaMA · 2026-05-30

一名开发者记录了为在旧款戴尔PowerEdge R730服务器上运行NVIDIA RTX Pro 6000 Blackwell GPU所需进行的大量硬件和固件破解工作,从而实现了650K上下文长度的本地AI推理。

0 人收藏 0 人点赞
#pcie

AMD将发布可插拔GPU

Reddit r/LocalLLaMA · 2026-05-07

AMD即将发布基于PCIe的新型可插拔Instinct GPU,面向企业AI市场,为本地大语言模型部署提供潜在的新硬件选择。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈