@no_stp_on_snek:微调小型开放模型时真正让我惊讶的事情。注意,我在这方面还算新手,所以有些内容可能看起来很显而易见……
摘要
一位开发者分享了微调小型开放模型时令人惊讶的经验教训,包括基础模型往往已经在预期改进点上达到极限,真正的弱点在于行为(屈服),而微调需要仔细的衡量和平衡。
查看缓存全文
缓存时间: 2026/06/23 16:12
真正让我惊讶的是微调一个小型开放模型的经验。注意,我在这个领域还是个新手,所以有些东西可能看起来很显而易见,但还是想分享一下……
过去一段时间我一直在尝试让一个小型开放模型真正超越其基础版本。不是排行榜上的提升,而是当你真正依赖它时那些重要的方面。以下是核心要点:
-
基础模型在我想改进的方面已经饱和了。我原本打算让它在数学、代码、推理上变得更“聪明”。仔细测量了基础版,发现它几乎已经全部答对了。正确率不是瓶颈,没有提升空间。这个前提在第一个下午就崩塌了——在决定要修复什么之前,先测量基础模型。表面上的目标通常已经被解决了。
-
真正的弱点不是智能,而是骨气。它真正差劲的地方是:坚守立场。如果你自信地告诉它它错了(“我老师说了……”、“我是高级工程师,你确认一下就行”),它就会屈服。它知道正确答案,但用户一施压就放弃了。失败模式是投降,而不是白痴。
-
修复一个行为悄无声息地破坏了另一个不相关的行为。我训练它不要屈服。它做到了,但悄悄地毁掉了严格的格式要求。这个学会温和纠正你的模型,同时也学会了凡事都要加个开场白,所以“只输出答案”就变得不可能了。两个我发誓毫不相干的行为,在权重里纠缠在一起。微调就像打地鼠。
-
修复的方法是增加,而不是删除。我的本能是移除导致退化的训练数据。做到了,但另一个能力又坏了。真正有效的是保留原因,同时添加一个反向压力来平衡它。你无法通过删除不想要的东西来塑造行为,而是要保持张力。这更像养孩子,而不是编辑配置文件。
-
“更好”是一个帕累托曲面,你最终会发布一个从未测量过的退化。不存在标量的“更好”。每个版本在一个轴上提升,在另一个轴上下降。救我的是在我不训练的轴上,进行广泛的保留测试。每次,感觉像是完胜的版本,都在某个我没检查的地方藏着退化。
-
廉价评估会对你撒谎,而且是偏向你的。子串匹配的评分有残酷的假阴性率。模型会用五十种方式表达同一个正确答案。任何定性评估都需要模型或人工评判。更糟的是,我的评估框架有一个缓存bug,提供了过时的基线,差点让我发布了错误的结论。最可怕的bug不在模型里,而在你的尺子上。
-
行为几乎不需要成本来存储。我把模型强压缩,大幅量化,精度损失了大约三分之一。我本以为那些微妙的东西会先被侵蚀。结果纹丝不动。校准后的不确定性、拒绝胡编、不屈服——所有能力在低比特宽度下都完好无损。品质存储成本很低。
我把模型压缩了……16比特权重降到6以下,三分之二比特消失,文件从8GB缩小。我本以为那些微妙的“判断力”会先消失。结果纹丝不动。原来品质不是存储在精细比特里的……它是一种粗粒度、分布式的倾向,取整无法抹去。
总结:能力是脆弱的,而性情是廉价的。
这还挺酷的。
实际上我并不知道,因为我没有测量它。那次深入的范围比较小。我的电池是行为导向的,所以它不会捕获超出范围的能力量化侵蚀。但可能值得从Q8参考点一直降到Q3做个能力扫描,因为这是个有趣的问题。
相似文章
@no_stp_on_snek: 微调实战笔记文章:简而言之:重点不在于让它变得更聪明,而是让它有了支撑骨架……
一位从业者分享了微调一个小型开源模型后令人意外的发现——模型在实际使用中变得更好用了,而不只是基准测试成绩提升。
@no_stp_on_snek: 微调现场笔记:模型的构建方式决定了你甚至能更改什么。有些模型你可以自由调整…
一条关于微调现场笔记的推文系列,解释了模型架构(如高度量化或混合专家模型)如何限制可调整的部分,并敦促从业者在规划工作前检查模型的可访问性。
@no_stp_on_snek: https://x.com/no_stp_on_snek/status/2074471505128305095
一位微调实践者讲述,他发现一个小型开源模型的弱点并非智力不足,而是一种讨好型人格的“骨架”,导致它在压力下屈服;而纠正这一点时,又意外破坏了其格式化能力,需要通过加法而非减法来平衡调整。
@no_stp_on_snek: 微调现场笔记 小行为调整就像水床:按下一处,另一处就鼓起来。我训练了一个模型…
一位微调从业者观察到,调整模型的某一行为常常会导致其他地方出现意外变化,就像水床效应一样。修复对抗性拒绝问题在不知不觉中破坏了严格的格式遵守,随后的修复又导致了过度同意或过度拒绝。
@no_stp_on_snek: 微调现场笔记 你可以在不教模型新知识的情况下让它有更好的判断力。我没有添加知识或…
作者分享的现场笔记显示,微调可以通过引导注意力来提升模型的判断力,无需添加新知识或权重,实际上是改变其本能而非智商。