Pyrecall 开源工具:检测 LLM 微调中的灾难性遗忘 [P]
摘要
Pyrecall 是一款新的开源工具,能够检测 LLM 微调中的灾难性遗忘,通过快照训练前后的技能分数,标记性能回退,并回滚 LoRA 适配器。该工具完全在本地运行,无需外部 API。
很惊讶在持续学习研究如此之多的情况下,竟然没有针对这一问题的真正工具。我构建了 Pyrecall 来填补这一空白。它可以快照微调前后的技能分数,标记性能回退,并按名称回滚 LoRA 适配器。完全本地运行,无需外部 API。v0.1.0,MIT 许可证,pip install pyrecall。对于基准设计——这是我信心最不足的部分——很好奇有没有人有想法。 [https://github.com/Arths17/Pyrecall](https://github.com/Arths17/Pyrecall)
相似文章
少量神经元揭示LLM何时误用工具:面向可靠工具使用的稀疏检测与选择性引导
本文介绍了PRISMS,一种利用少量针对特定失败的MLP神经元,通过稀疏读出检测和引导LLM工具使用错误(过度调用、缺失调用、无效参数)的框架,从而提升多个模型系列的工具使用可靠性。
ReCoLoRA:面向连续大语言模型微调的频谱感知递归整合方法
ReCoLoRA 是一个频谱感知框架,用于大型语言模型的连续微调。它通过递归整合低秩适配器来防止灾难性遗忘,在多个骨干网络的连续 GLUE 任务上取得了更优的性能。
利用强化微调克服视觉连续学习中的灾难性遗忘
本文提出保留感知策略优化(RaPO),通过强化微调缓解视觉连续学习中的灾难性遗忘。RaPO采用轨迹级奖励塑形和跨任务优势归一化,缩小了类增量学习和域增量学习中强化微调与监督微调之间的差距。
从回想到遗忘:为个性化智能体评估长期记忆
研究者推出 Memora 基准,衡量大模型在持续数周至数月的对话中保留、更新与遗忘用户长期记忆的能力,发现模型常复用已失效记忆。
Reflective Recovery: 一种通过从错误中学习进行推理的自监督方法
本文介绍了Reflective Recovery,这是一种自监督方法,通过将失败轨迹转化为训练数据来增强LLM推理能力,打破缩放崩溃并实现涌现性自我纠正。