B空间拥挤:为LoRA融合校准共享方向
摘要
# 论文页 - B空间拥挤:为LoRA融合校准共享方向 来源:[https://huggingface.co/papers/2604.16826](https://huggingface.co/papers/2604.16826) 发布于4月18日 · 由[https://huggingface.co/yixuantt](https://huggingface.co/yixuantt)提交 [](https://huggingface.co/yixuantt) [yixuan](https://huggingface.co/yixuantt) 于4月21日上传 ## 摘要 通过校准共享方向,可提升LoRA适配器融合性能。
查看缓存全文
缓存时间: 2026/04/21 07:21
论文页面 - Crowded in B-Space:为 LoRA 合并校准共享方向
来源:https://huggingface.co/papers/2604.16826
发布于 4 月 18 日
由 https://huggingface.co/yixuantt 提交
yixuan (https://huggingface.co/yixuantt) 于 4 月 21 日
摘要
通过单独校准输出侧矩阵 B,可在减少共享方向干扰的同时保留任务特定信息,从而提升 LoRA 适配器合并性能。
将分别训练的 LoRA 适配器合并是联合多任务训练的可行替代方案,但往往会损害性能。现有方法通常把 LoRA 更新 ΔW = BA 视为整体,不区分两个 LoRA 矩阵。我们发现,LoRA 合并干扰的主要来源是输出侧矩阵 B:跨任务时,B 反复使用少量共享方向,而 A 则保持更强的任务特异性。结果,合并后的适配器过度强调这些共享方向,导致任务特定信息丢失。我们提出 Pico(Pre-merge interference calibration in output-space),一种无需数据的方法,在合并前通过降低过度共享方向的权重并重新缩放合并后的更新来校准 B。Pico 可直接嵌入现有合并方法,如 Task Arithmetic、TIES 和 TSV-M。在数学、编程、金融和医学领域的八个基准上,Pico 将对应基线方法的平均准确率提高 3.4–8.3 分,并取得最佳整体平均性能。Pico 还让合并后的适配器超越使用全部任务数据训练的 LoRA。这些结果表明,将两个 LoRA 矩阵分开处理能让合并效果更好。
查看 arXiv 页面 (https://arxiv.org/abs/2604.16826)
查看 PDF (https://arxiv.org/pdf/2604.16826)
加入收藏
在您的 agent 中获取本文:
hf papers read 2604.16826
还没装最新 CLI?
curl -LsSf https://hf.co/cli/install.sh | bash
引用该论文的模型 0
暂无模型引用本文
在模型 README.md 中引用 arxiv.org/abs/2604.16826 即可在此显示。
引用该论文的数据集 0
暂无数据集引用本文
在数据集 README.md 中引用 arxiv.org/abs/2604.16826 即可在此显示。
引用该论文的 Spaces 0
暂无 Space 引用本文
在 Space README.md 中引用 arxiv.org/abs/2604.16826 即可在此显示。
收录该论文的合集 0
暂无合集收录本文
创建合集 并将本文加入,即可在此显示。
相似文章
CT-Merging: 共识方向与任务级缩放用于LoRA适配器合并
CT-Merging 提出了一种通过从任务子空间投影器估计共识方向并分配任务级RMS系数缩放来合并LoRA适配器的方法,在DC-Merge CLIP适配器基准上取得了优越的性能。
从“弱”信号到强模型:利用LoRA合并进行偏好差值聚合
本文介绍了偏好差值聚合(PDA)和几何对齐合并(GAM),通过LoRA合并将来自弱模型对的多个“弱”偏好信号进行聚合,在知识推理和智能体搜索任务上平均将强LLM的性能提升超过6%。
路由不够:诊断 MoE+LoRA 微调中的适配器子空间竞争
本文诊断了 MoE+LoRA 微调中的适配器内竞争,并介绍了 SpawnLoRA,该方法动态添加子适配器以减少跨领域的负迁移。
超越LoRA:稀疏诱导的适配是否更好?
本文提出了对LoRA的稀疏诱导适配方法,包括廉价LoRA(cLA)和链式循环变体(c³LA),并提供了理论泛化界以及实证评估,结果显示在保持竞争性性能的同时,训练时间最多减少10%,峰值GPU内存节省最多15%。
PermDoRA——理解语言模型中的适配器干扰:参数空间几何的局限性
本文介绍了DoRA-RBAC,一个用于组合LLM适配器的框架,并测试了几何感知合并是否能提升多域性能。结果显示,与标准平均方法相比,没有一致的改进,表明适配器干扰并非主要由参数空间几何驱动。