q8

标签

Cards List
#q8

为Qwen3 30B模型(Q8量化)搭建本地AI服务器:这个硬件合适吗?

Reddit r/AI_Agents · 2026-07-20

讨论搭建用于Qwen3 30B模型(Q8量化)的本地AI服务器,质疑所选硬件是否合适。

0 人收藏 0 人点赞
#q8

在32GB显存上以Q8量化使用Qwen3.6-27,接近100K上下文

Reddit r/LocalLLaMA · 2026-07-05

用户分享了他们在拥有32GB显存的RTX 5090上,使用Q8量化的Qwen3.6-27B模型尝试达到115K上下文长度的配置与实验过程,并给出了基准测试结果,以及上下文长度与kv-cache量化之间的权衡。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈