parameter-efficient-fine-tuning

标签

Cards List
#parameter-efficient-fine-tuning

Learning to Adapt Cross-Domain Preferences via Meta-LoRA for LLM Personalization

arXiv cs.AI · 昨天 缓存

This paper introduces PAC-Bayes-regularized Meta-LoRA for cross-domain LLM personalization, enabling zero- and few-shot adaptation to user preferences while preventing overfitting under sparse evidence. Experiments on benchmarks like HiCUPID show significant improvements in cross-domain win rates and cold-start scenarios.

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

LoRA-Diffusion:基于低秩轨迹分解的参数高效微调

arXiv cs.CL · 昨天 缓存

LoRA-Diffusion 提出了一种针对扩散语言模型的参数高效微调方法,通过对去噪轨迹而非模型权重进行低秩分解,仅使用 1.2% 的轨迹适配器参数即可获得具有竞争力的性能。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

SeFoRA:具有异构客户端秩的草图聚合联邦低秩适配

arXiv cs.LG · 3天前 缓存

SeFoRA 是一种提出的联邦 LoRA 算法,利用草图聚合来处理异构客户端秩并缓解双线性失配问题。它包含一个具有收敛保证的秩同质变体,并在 RoBERTa-Large 微调上展示了最先进的性能。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

YOLO-PEFT:YOLO系列上的参数高效微调

Hugging Face Daily Papers · 2026-08-07 缓存

YOLO-PEFT 是一个结构感知框架,将适配器放置建模为约束规划问题,用于 YOLO 检测器的参数高效微调,在降低内存占用的同时取得了优于全量微调的 mAP。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

Geometry-Informed Parameter-Efficient Fine-Tuning of Pre-trained Molecular GNNs for Blood-Brain Barrier Permeability Prediction

arXiv cs.LG · 2026-08-06 缓存

This paper introduces BBBP-GeoPEFT, a geometry-informed parameter-efficient fine-tuning framework for pre-trained molecular GNNs targeting blood-brain barrier permeability prediction, achieving competitive performance while updating only 10.1% of parameters.

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

MoEGen:用于实例自适应LoRA生成的专家混合方法

arXiv cs.CL · 2026-08-05 缓存

本文提出MoEGen,一种参数高效的微调框架,利用专家混合技术通过专家码和轻量级超网络生成实例自适应的LoRA更新,在不针对每个专家存储独立适配器的情况下提升了常识推理基准的性能。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

LARA:残差流中的轻量级适配器,用于可组合的适应与对齐

arXiv cs.LG · 2026-08-03 缓存

LARA 是一种高效适应方法,它向冻结模型的残差流添加低秩修正,而不是修改权重,在匹配 LoRA 性能的同时实现可组合行为和推理时调控。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

MoE$^2$-LoRA:当MoE模型遇上MoE风格的低秩适配

arXiv cs.CL · 2026-07-27 缓存

MoE2-LoRA 引入了一种双通道路由条件投影(Routing-Conditioned Projection)和一个全局 LoRA 专家池,以实现用于微调 MoE 模型的 MoE 风格低秩适配,在保留通用能力的同时取得了最先进的准确率。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

CT-Merging: 共识方向与任务级缩放用于LoRA适配器合并

arXiv cs.LG · 2026-07-24 缓存

CT-Merging 提出了一种通过从任务子空间投影器估计共识方向并分配任务级RMS系数缩放来合并LoRA适配器的方法,在DC-Merge CLIP适配器基准上取得了优越的性能。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

SOS-LoRA: 静态正交子空间低秩适应结合固定多尺度缩放

arXiv cs.LG · 2026-07-21 缓存

SOS-LoRA 通过将秩预算分解为具有固定多尺度缩放的静态正交低秩专家来扩展 LoRA,在不增加推理成本的情况下提升了在推理、NLU 和数学基准上的微调性能。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

通过小型语言模型实现AI民主化:面向本地部署的结构化基准测试与参数高效微调

arXiv cs.AI · 2026-07-21 缓存

本文在结构化基准上评估了九个开放权重的小型语言模型(参数量135M至3B),并证明参数高效微调显著提升了准确率,使其在结构化小众工作负载的本地部署中具备可行性。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

CARE-LoRA: 基于压缩激活重建的内存高效LoRA微调框架

arXiv cs.LG · 2026-07-15 缓存

CARE-LoRA提出了一种压缩激活重建框架,通过利用低秩投影来减少LoRA微调过程中的内存消耗。该方法在降低内存占用的同时,实现了具有竞争力的性能。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

SQuaD-SQL: 利用LLM引导的知识蒸馏实现小型语言模型的高效文本到SQL

arXiv cs.CL · 2026-07-10 缓存

SQuaD-SQL使用LLM引导的知识蒸馏训练小型语言模型进行Text-to-SQL,在WikiSQL上达到86.9%的执行准确率,同时提供更快的推理速度和更低的内存占用。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

ReCoLoRA:面向连续大语言模型微调的频谱感知递归整合方法

arXiv cs.LG · 2026-07-10 缓存

ReCoLoRA 是一个频谱感知框架,用于大型语言模型的连续微调。它通过递归整合低秩适配器来防止灾难性遗忘,在多个骨干网络的连续 GLUE 任务上取得了更优的性能。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

FRAME: 使用分数阶傅里叶专家混合体学习适应域

arXiv cs.LG · 2026-07-02 缓存

提出FRAME,一种使用可学习分数阶傅里叶阶数在空间域和频谱域之间插值的专家混合适配器,提升了LLMs在多个基准上的参数高效微调性能。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

学习选择,而非重新学习:推理LoRA的硬路由混合

arXiv cs.AI · 2026-07-01 缓存

提出了Hard-Routed MoR-LoRA,一种两阶段框架,通过硬top-1路由组合冻结的推理LoRA专家,相比软路由基线,在保留专家行为的同时需要更少的可训练参数。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

基于汉克尔降阶建模的SSM适配器:注入位置决定长上下文微调中的任务适配性

arXiv cs.LG · 2026-06-26 缓存

介绍了一种基于汉克尔降阶模型(HRM)的适配器,这是一种通过平衡截断初始化的SSM残差模块,用于参数高效微调,在长上下文任务中优于LoRA。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

@jbhuang0604: LoRA, low-rank adaptation, is arguably the most popular parameter-efficient fine-tuning method for LLMs. But how does i…

X AI KOLs Timeline · 2026-06-25 缓存

LoRA(低秩适配)是LLM最流行的参数高效微调方法,视频介绍了LoRA及其变体(LoRA+、QLoRA、VeRA、DoRA)的工作原理。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

@0xSero: Highly recommended educational content. LoRA is one of the coolest things to dabble in, lets anyone fine tune models re…

X AI KOLs Timeline · 2026-06-22 缓存

本文详细介绍了 LoRA 及其变体(QLoRA、VeRA、DoRA)的原理,解释了如何通过低秩分解减少可训练参数,实现高效微调大型模型。

0 人收藏 0 人点赞
#parameter-efficient-fine-tuning

ARIADNE:推理时适配器动态选择的无关路由

arXiv cs.AI · 2026-06-18 缓存

提出ARIADNE,一种无需训练、适配器无关的路由框架,通过在嵌入空间中测量输入与适配器特定质心的接近度,在推理时选择最优的PEFT适配器,在23个任务上恢复了97.44%的上限性能。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈