Qwen 3.8 27b 对比 Deepseek Flash

Reddit r/LocalLLaMA 模型

摘要

这篇文章对比了开源AI模型Qwen 3.8 (27B) 和 Deepseek Flash,讨论了基准测试,并寻求用户经验以评估它们的性能。

大家好,开源发布最近几周真是太棒了。我对 DS flash 的最终检查点印象深刻,一直在玩它,直到 Qwen 3.8 发布。我查看了基准测试,不知道该怎么想了,这样一个小模型怎么能与一个大10倍的模型竞争(当然我听说27B不是MoE,但还是...)。你们中有人用过两者吗?能告诉我3.8是否真的那么好,还是只是基准测试优化?对于用过两者的人,你们的感受是什么?谢谢。
查看原文

相似文章

Jackrong/Qwen3.5-9B-DeepSeek-V4-Flash-GGUF

Hugging Face Models Trending

本文档介绍 Qwen3.5-9B-DeepSeek-V4-Flash,这是一款通过知识蒸馏技术将 DeepSeek-V4 的推理能力迁移至 9B 参数小模型中的 AI 模型,旨在实现高效推理。

Qwen 3.6 27B 在 DeepSWE 上的表现

Reddit r/LocalLLaMA

Qwen 3.6 27B 在 DeepSWE 基准测试中获得了 2% 的分数,排名 18/20,高于 Haiku 4.5 和 Minimax M2.7,突显了本地模型与前沿模型之间的差距。