有人在5070ti(16GB)上运行qwen 3.8 27b吗?

Reddit r/LocalLLaMA 新闻

摘要

用户询问在配备16GB显存的5070ti GPU上使用量化运行Qwen 3.8 27b模型是否可行,主要用于智能体编码。

大家好。我最近决定花点钱把我的4070ti(12GB)升级到5070ti(16GB)。我想知道是否有合理的量化方案,可以在新卡上运行qwen 3.8 27b并获得不错的每秒token数(tp/s),主要用于智能体编码。我听说一些4bit量化版本已经足够好了。或者我仍然处于不可行的境地?有人在用这张卡吗?5070ti 16GB显存 32GB DDR4内存
查看原文

相似文章

三元 Qwen3.6 27B 在 3090 上测试!

Reddit r/LocalLLaMA

用户在 RTX 3090 上测试了三元量化版本的 Qwen3.6 27B,使用两个槽位和 100k KV 缓存,占用 21GB 显存,达到了 60 tk/s 的速度,质量良好且工具调用稳定。