@MiaAI_lab: Orinth-1.0-35b MoE 看起来比 Qwen 3.6 35b 好得多,特别是在 Terminal-Bench 2.1 和 SWE Atlas 上。

X AI KOLs Timeline 模型

摘要

Orinth-1.0-35b MoE 在 Terminal-Bench 2.1 和 SWE Atlas 基准测试上优于 Qwen 3.6 35b。

Orinth-1.0-35b MoE 看起来比 Qwen 3.6 35b 好得多,特别是在 Terminal-Bench 2.1 和 SWE Atlas 上。https://t.co/dDt2GZjxuO
查看原文
查看缓存全文

缓存时间: 2026/06/26 12:11

Orinth-1.0-35b MoE 明显优于 Qwen 3.6 35b,尤其在 Terminal-Bench 2.1 和 SWE Atlas 上表现出色。https://t.co/dDt2GZjxuO

相似文章

Qwen 3.6 35B A3B 的热度绝非虚名!

Reddit r/LocalLLaMA

作者对小型本地 LLM 进行了基准测试,重点突出了 Qwen 3.6 35B A3B,其将学术代码与研究论文进行映射的能力优于 Gemma 4 和 Nemotron 3 Nano 等模型。

RTX 3090 本地基准测试 - Qwen3.6 27b 对比 Ornith

Reddit r/LocalLLaMA

用户在RTX 3090上使用inspect-ai运行本地基准测试,比较Qwen3.6 27b、Gemma4 26B和Ornith1.0 35B。结果显示Qwen在知识和编码方面领先,而Ornith在接地性和召回方面具有竞争力。