标签
Imprint Reader 是一个经过训练的模型,用于描述语言模型中的冻结权重更新,从而实现行为干预以提升安全性和推理能力。它使用 SMaRT 进行训练,MetaEdit 进行干预,展示了自然语言解读的可行性。