Qwen 3.8 Low and Medium 是最强的

Reddit r/LocalLLaMA 模型

摘要

Artificial Analysis 对 Qwen 3.8 Low and Medium 模型进行了基准测试,显示出优异的成绩,证实了它们的成功超越了过度思考。

Artificial Analysis 刚刚对 Qwen 3.8 Low and Medium 进行了基准测试,成绩好得惊人,证明了早期的成功并非仅仅是由过度思考促成的。
查看原文

相似文章

Qwen 3.8 27B 表现优异,但默认启用过度推理模式

Simon Willison's Blog

Qwen 3.8 27B 是阿里巴巴通义千问实验室推出的一款强大的开源270亿参数多模态大语言模型。它在基准测试中表现突出,但被批评默认启用过度推理模式,这在消费级硬件上拖慢了运行速度。

Qwen 3.8 27B Aider 得分

Reddit r/LocalLLaMA

用户使用 Aider 对 Qwen 3.8 27B 进行基准测试,发现其得分为 72.9,与 Gemini 2.5 Pro 相当,并通过 vLLM 在 MacBook 上进行本地推理,优于其他最先进模型。

Qwen 3.8 27b 即使在 Q3_xxs 下也很强大

Reddit r/LocalLLaMA

用户发现 Qwen 3.8 27b 在 Q3 量化下对编码任务非常高效,推理速度快,超越了之前的模型,尽管在日常对话中存在一些小问题。

Qwen 3.6 35B A3B 的热度绝非虚名!

Reddit r/LocalLLaMA

作者对小型本地 LLM 进行了基准测试,重点突出了 Qwen 3.6 35B A3B,其将学术代码与研究论文进行映射的能力优于 Gemma 4 和 Nemotron 3 Nano 等模型。