@rohanpaul_ai: 精美的视觉展示,有人在本地运行 Qwen 3.8 27B,使用 RTX 5090 32 GB 显存系统,速度达到 115 tokens/秒 注意,Qw…

X AI KOLs Timeline 模型

摘要

推文重点介绍了在 RTX 5090 系统上本地运行 Qwen 3.8 27B 模型,配备 32GB 显存,达到 115 tokens/秒的速度,并指出官方 BF16 检查点大小为 55.6GB。

精美的视觉展示,有人在本地运行 Qwen 3.8 27B,使用 RTX 5090 32 GB 显存系统,速度达到 115 tokens/秒 注意,Qwen3.8-27B 的官方 BF16 检查点大小为 55.6 GB https://t.co/mvwt6J4rnt
查看原文
查看缓存全文

缓存时间: 2026/08/17 18:16

一张某人奔跑的精美视觉图,本地运行Qwen 3.8 27B模型,使用RTX 5090 32GB显存系统,速度达115 tokens/秒。
请注意,Qwen3.8-27B的官方BF16检查点大小为55.6 GB
https://t.co/mvwt6J4rnt

相似文章

Wow!Qwen 3.6:35b-a3b 在 3090 上……太惊人了。

Reddit r/artificial

一位用户分享了在二手 RTX 3090 上运行量化版 Qwen 3.6:35b-a3b 模型的惊人结果:将模型放入显存后,输出速度达到每秒 160 个 token,并以 75 秒的视频处理时间展示了视觉能力。