Inkling-Small-276B-12B,努力 "max" 对比 Qwen3.6-27B
摘要
Inkling-Small-276B-12B(一个混合专家模型,总参数量276B,活跃参数量12B)与 Qwen3.6-27B 之间的对比基准测试,使用 'max' 努力配置来评估性能。
暂无内容
相似文章
Qwen/Qwen3.6-35B-A3B
Qwen 发布 Qwen3.6-35B-A3B,一款开源权重的混合专家(MoE)模型,总参数量 35B,激活参数量 3B,在智能体编码和推理能力保持方面实现显著提升。
在CPU函数调用上对Needle 26M和Qwen3-0.6B进行基准测试,50个查询覆盖5个难度等级。体积小23倍的模型在准确率上胜出,速度也快4.4倍。
一项在CPU函数调用上比较Needle 26M和Qwen3-0.6B的基准测试显示,较小的Needle模型在准确率和速度上胜出,但失败模式截然不同:Needle选择错误的工具,而Qwen3则经常无法发出工具调用。
需要第二双眼睛,这个Qwen3.6 27B量化方案总是用更少的思考且正确
作者分享了一个Qwen3.6 27B的量化方案,该方案使模型使用显著更少的思考令牌,同时仍然产生正确的答案,从而在数学基准测试中实现更快的推理。
Qwen 3.6 27B 在 DeepSWE 上的表现
Qwen 3.6 27B 在 DeepSWE 基准测试中获得了 2% 的分数,排名 18/20,高于 Haiku 4.5 和 Minimax M2.7,突显了本地模型与前沿模型之间的差距。
GLM 5.2 Q1_S 对比 Qwen 27B Q8
一位爱好者将高度量化的 GLM 5.2(Q1_S)与高量化版本的 Qwen 27B(Q8)在代码生成任务上进行对比,发现量化程度较低的大模型在质量和完整性上明显优于量化程度较高的小模型。