qwen-3-6-27b

标签

Cards List
#qwen-3-6-27b

我测试了 llama.cpp 在 Qwen 3.6 27B 上的所有推测性解码方法:MTP ~2.7x, DFlash ~3.7x, n-gram 堆叠在真实编码中达到 ~6x。本地 AI 获胜。我在 RTX 6000 PRO 上的发现。

Reddit r/LocalLLaMA · 2026-07-16

llama.cpp 在 Qwen 3.6 27B 上的推测性解码方法的全面基准测试表明,在 DFlash 上叠加 n-gram 堆叠在迭代编码任务中实现了高达 6 倍的加速,其中 ngram-mod 贡献了大部分增益且零 VRAM 成本。

0 人收藏 0 人点赞
#qwen-3-6-27b

张量拆分模式:在最新版 llama.cpp 中使用 Qwen-3.6-27b 时出现 CUDA 错误

Reddit r/LocalLLaMA · 2026-06-03

用户在最新的llama.cpp和Qwen-3.6-27b模型下使用tensor split模式时,在配备双RTX 3090、Ubuntu Server 24.04和Docker的环境中报告了CUDA错误。

0 人收藏 0 人点赞
#qwen-3-6-27b

从没见过像 Qwen 3.6 27B 这么“卷”的 Agent

Reddit r/LocalLLaMA · 2026-04-23

Reddit 用户称 Qwen 3.6-27B 表现出罕见的主动行为,无需提示就自主编写、测试并修复代码。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈