@spiritbuun: 我的第一个量化模型将在下周发布。我已经为此工作了一个多月。配方已经...
摘要
宣布即将发布使用量化感知训练(QAT)的B27模型量化版本,号称迄今为止最智能的B27。
我的第一个量化模型将在下周发布。我已经为此工作了一个多月。配方已经锁定。QAT已完成。这不仅仅是量化。这是有史以来最智能的B27。 https://t.co/4t4a4GYHTS
查看缓存全文
缓存时间: 2026/06/02 23:39
我的第一个量化模型将在下周发布。我已经为此努力了一个多月。方案已经确定。QAT已完成。这不只是量化——这是有史以来最聪明的B27。https://t.co/4t4a4GYHTS
相似文章
需要第二双眼睛,这个Qwen3.6 27B量化方案总是用更少的思考且正确
作者分享了一个Qwen3.6 27B的量化方案,该方案使模型使用显著更少的思考令牌,同时仍然产生正确的答案,从而在数学基准测试中实现更快的推理。
@Ex0byt:激活、切片、拼接、微调数日,外加15小时屏息凝神的NVFP4校准/传播轮次……
社区成员发布了Qwen3.6-35B-A3B-PRISM-NVFP4——一款经过多轮、数据集校准、零损耗的NVFP4量化版Qwen模型。
我构建了一个工具,在量化前实际测试哪些权重重要,而不是靠猜测(Qwen3.6-27B,三个版本:Bedrock/Tightrope/Gambit)
一位开发者构建了一个测试框架,在量化过程中测量每个权重组的 KL 散度,从而生成了 Qwen3.6-27B 的三个定制量化版本(Bedrock、Tightrope、Gambit),实现了优化的压缩。工具调用被确定为量化下最早退化的能力。
在本地定期使用Bonsai 27b 1b量化版
一位用户分享了在16GB MacBook Air上本地使用Bonsai 27b的1-bit量化版进行日常聊天、辅导Go语言以及分析个人笔记的积极体验,称赞其智能性和小巧的体积。
@coffeecup2020: TurboQuant - Qwopus3.6-27B-v2-TQ3_4S.gguf 通过gpqa测试确认,这非常棒。https://huggingface.co/YTan…
TurboQuant 是 Qwopus3.6-27B-v2 模型的 GGUF 量化版本,经 GPQA 测试结果确认,并在 Hugging Face 上分享,感谢 Jackrong 和 KyleHessling。