我选择模型的经验法则

Reddit r/LocalLLaMA 新闻

摘要

作者分享个人经验,展示像 Qwen 27B 这样的大语言模型如何大幅缩短编程任务时间,并提供了模型选择的经验法则。

这主要是为了设定预期,因为个人在没有大语言模型的情况下,可能需要 3 天(15 小时的主动编程时间)来调试或实现一个功能,但使用 Qwen 27B(甚至在 Qwen 3.8 之前)则只需 4 小时。而且,是的,0.5 tok/s 是人类水平,还没有算上删除和暂停的时间,这也是我能放心地过夜对代码库进行全面分析,或进行金融科技和深度研究的原因。
查看原文

相似文章

中型MoE大语言模型

Reddit r/LocalLLaMA

用户寻求中等规模的混合专家大语言模型(MoE)推荐(最高60B参数(float8)/110B参数(mxfp4)),列出了Qwen 3.5 35B、Gemma 4 A4B和Nemotron 3 Nano,并询问除此之外还有哪些小众选择。

我现在(主要)根据速度而非智能来挑选模型

Lobsters Hottest

作者认为前沿大语言模型已经达到了“足够好”的智能门槛,因此现在选择模型时更看重速度而非原始智能,并举例说像GLM5.2和DeepSeek V4 Flash这样快速的开源权重模型已成为日常主力。