knowledge-circuit

标签

Cards List
#knowledge-circuit

从机制上理解大语言模型微调中记忆知识无法泛化的原因

arXiv cs.AI · 2026-07-10 缓存

本文形式化了大语言模型微调中的“知道-使用鸿沟”,即模型记忆事实但无法泛化。引入了自修补干预方法,并确定知识回路错位为根本原因,通过简单启发式方法恢复了58-75%的泛化失败。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈