@Snixtp: 针对单张 RTX 3090 的更多能效测试 长文速读:- 我在单张 RTX 3090 上测试了 8 个本地大语言模型(LLM),功率限制从 100W 到 45…

X AI KOLs Following 新闻

摘要

本文展示了 8 个本地大语言模型在 RTX 3090 上的基准测试结果,显示功率能效在约 225W 时达到峰值,而在满功率下收益递减。

针对单张 RTX 3090 的更多能效测试 长文速读: - 我在单张 RTX 3090 上测试了 8 个本地大语言模型(LLM),功率限制范围从 100W 到 450W。 - 在整个测试集中,最佳能效始终出现在 225W 至 250W 区间。 - 在 225W 功率下,显卡平均输出速度为 90.4 tok/s,能效比为 0.4167 tok/s/W。 - 在 450W 功率下,速度提升至 107.1 tok/s,但能效比下降至 0.2731 tok/s/W。 - 因此,最大功耗仅带来了约 16.7 tok/s 的速度提升,却多消耗了约 184W 的电力。
查看原文

相似文章

探寻4x 3090的甜点

Reddit r/LocalLLaMA

一位用户分享了在运行Qwen3.6-27B与vLLM的4x RTX 3090平台上进行的功耗限制测试,发现220W是在最小化吞吐量损失下实现峰值效率的甜点。

[基准测试] 5090RTX:提示解析、Token 生成与功耗等级

Reddit r/LocalLLaMA

一位用户使用 llama.cpp 对 Nvidia 5090 RTX GPU 进行 LLM 推理基准测试,测量了不同功耗水平下的提示处理和 token 生成情况,发现提示处理对功耗限制更为敏感,而 token 生成相对不敏感,并指出了与 4090 RTX 的差异。