开发们 - 你有64GB显存 - 你用什么模型写代码?
摘要
一位拥有64GB显存的开发者分享了他使用unsloth版Qwen 3.5 122b-a10b模型进行编码的偏好,并向社区征求推荐。
我目前锁定的是unsloth版Qwen 3.5 122b-a10b模型(UD-IQ4_NL)。在100k bf16上下文窗口下,我只将少量层加载到CPU/内存中,运行速度约30 tok/s,对我来说足够了。我测试过很多模型,花了数小时,但目前这款给我留下了深刻印象。我也会根据需求使用Qwen 3.6模型(两个版本),但我觉得这个大个头即将成为我的日常主力。很想知道其他有类似显存容量的人用的是什么?
相似文章
高显存本地编码模型——依然首选 Qwen 3.6 27B 吗?
用户分享了使用 Qwen 3.6 27B 进行本地编码任务的经验,并寻求适合拥有 224GB 显存系统的更大模型(100B 以上)的推荐。
5090 + 96GB RAM,对于编码任务,是否有比Qwen3.8-27B更好的选择?
用户正在询问是否有比Qwen3.8-27B更适合编码任务的AI模型,并指出其在高层推理、系统架构、关注点分离和抽象方面的局限性。
16GB显存炼狱讨论帖
一个讨论帖,分享在16GB显存Windows系统上运行AI模型如Qwen3.8-27B的配置和技巧,专注于内存优化技术。
在6GB显存和64GB内存下,最佳通用无审查或有审查的编程模型是什么?
用户寻求在显存有限的硬件上本地运行的最佳无审查或有审查AI编程模型的推荐,目标是更快的响应时间和与Visual Studio和VS Code等开发工具的集成。
这里有多少人拥有24GB以上的GPU?
作者基于下载次数讨论了qwen 3.8 27b模型的低采用率,并估计很少有用户拥有用于高效本地LLM开发的高显存GPU。