relearning-attacks

标签

Cards List
#relearning-attacks

抵御重学攻击的鲁棒大语言模型遗忘:表征中的次要分量至关重要

arXiv cs.CL · 2026-05-13 缓存

本文介绍了次要分量遗忘(MCU),这是一种针对大语言模型遗忘的新颖方法,通过靶向表征中的次要分量来抵御重学攻击。它通过关注模型谱结构中的鲁棒方向,解决了现有方法的脆弱性问题。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈