并非所有秩都相等:预算感知的LoRA跨任务合并
摘要
本文介绍了Net Utility,一种用于预算感知LoRA合并的无数据度量,它优化跨任务的秩分配,在视觉任务上实现+2.1%的改进,在语言任务上实现+2.2%的改进,优于均匀方法。
查看缓存全文
缓存时间: 2026/09/29 00:07
论文页面 - 并非所有秩都平等:跨任务预算感知LoRA合并
来源:https://huggingface.co/papers/2609.22237
摘要
合并低秩适配器(LoRAs)有望消除推理时切换任务特定权重的开销。然而,现有的合并方法假设每一层都需要相同的秩预算。更进一步,某些方法还假设秩预算需要在各任务间均等分配。我们证明,这种统一预算假设是合并后性能与单任务LoRA性能之间差距的主要来源。然而,秩的选择本身是一个NP难问题。为此,我们引入了“净效用”(Net Utility)这一无需数据的度量指标。该方法首先将每个任务的LoRA通过其奇异值分解(SVD)进行分解,并根据每个奇异方向的任务效用及其对其他任务方向的干扰程度为其评分。接下来,我们对这些分数进行全局池化,以在所选方向总数受限的约束下,选出数值最高的奇异方向。所提出的净效用度量指标应用于五种不同的合并方法以及三个不同的合并空间之上。合并工作在两组任务上完成,分别涉及视觉任务和语言任务。基于净效用的秩分配方法优于未进行此类分配的对应方法。平均而言,它在视觉任务上实现了+2.1%的性能提升,在语言任务上实现了+2.2%的性能提升。
查看arXiv页面 (https://arxiv.org/abs/2609.22237) 查看PDF (https://arxiv.org/pdf/2609.22237) 添加至收藏夹 (https://huggingface.co/login?next=%2Fpapers%2F2609.22237)
在你的代理中获取本文:
hf papers read 2609.22237
没有最新的CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用本文的模型 0
无模型链接本文
在模型的README.md中引用 arxiv.org/abs/2609.22237 以从本页面链接。
引用本文的数据集 0
无数据集链接本文
在数据集的README.md中引用 arxiv.org/abs/2609.22237 以从本页面链接。
引用本文的空间 0
无空间链接本文
在空间的README.md中引用 arxiv.org/abs/2609.22237 以从本页面链接。
包含本文的集合 0
无集合包含本文
将本文添加至集合 (https://huggingface.co/new-collection) 以从本页面链接。
相似文章
单一学习率不够:LoRA微调的自适应各向异性学习率
本文提出了一种用于LoRA微调的自适应各向异性学习率模型,以解决模块内异质性问题,提升性能并在各基准测试中提高秩容量利用率。
Hybrid-LoRA:桥接全微调与低秩适应的后训练方法
Hybrid-LoRA提出了一种框架,选择性地对一小部分模块进行全微调,同时对其他模块使用LoRA,在显著降低计算成本的同时实现了接近全微调的性能。实验表明,与现有参数高效基线方法相比,性能提升高达5.65%。
B空间拥挤:为LoRA融合校准共享方向
# 论文页 - B空间拥挤:为LoRA融合校准共享方向 来源:[https://huggingface.co/papers/2604.16826](https://huggingface.co/papers/2604.16826) 发布于4月18日 · 由[https://huggingface.co/yixuantt](https://huggingface.co/yixuantt)提交 [](https://huggingface.co/yixuantt) [yixuan](https://huggingface.co/yixuantt) 于4月21日上传 ## 摘要 通过校准共享方向,可提升LoRA适配器融合性能。
基于各向同性曲率联合切空间优化的秩高效LoRA方法
本文介绍了Iso-LoRA,一种通过在切空间扰动上进行谱下降来促进奇异方向上均匀能量分布的优化器,从而增强LoRA,提高语言模型适配中的有效秩和下游性能。
扩散模型微调中的LoRA秩权衡解析
本文研究了在扩散模型微调中LoRA秩选择的权衡问题,表明中等较小的秩(如4和8)通过平衡FID分数与计算成本,能优化微调效率。