low-rank-adapters

Tag

Cards List
#low-rank-adapters

Just MLPs: Efficient Visual State Reconstruction for Multimodal Language Models

Hugging Face Daily Papers ↗ · 2d ago Cached

The paper proposes δ-Vision, a method to reduce computational overhead in multimodal language models by using lightweight low-rank adapters to reconstruct visual states efficiently without discarding visual tokens.

0 favorites 0 likes
#low-rank-adapters

ReCoLoRA: Spectrum-Aware Recursive Consolidation for Continual LLM Fine-Tuning

arXiv cs.LG ↗ · 2026-07-10 Cached

ReCoLoRA is a spectrum-aware framework for continual fine-tuning of large language models that uses recursive consolidation of low-rank adapters to prevent catastrophic forgetting, achieving improved performance on continual GLUE tasks across multiple backbones.

0 favorites 0 likes
#low-rank-adapters

Persona Cartography: Charting Language Model Personality Traits in Weight Space

arXiv cs.AI ↗ · 2026-07-10 Cached

This paper introduces a method for analyzing and controlling language model personalities using the OCEAN framework, training low-rank adapters to manipulate traits, and demonstrates additive composition and safety implications.

0 favorites 0 likes
#low-rank-adapters

Always Learning, Always Mixing: Efficient and Simple Data Mixing All The Time

arXiv cs.CL ↗ · 2026-05-18 Cached

This paper introduces OP-Mix, a data mixing algorithm that uses low-rank adapters trained on the current model to cheaply simulate candidate data mixtures, enabling efficient and unified data mixing across pretraining, continual midtraining, and continual instruction tuning. OP-Mix consistently finds near-optimal mixtures while using a fraction of the compute of baselines, improving pretraining perplexity by 6.3% and reducing compute by 66-95% in continual learning settings.

0 favorites 0 likes
#low-rank-adapters

Low-Rank Adapters Initialization via Gradient Surgery for Continual Learning

arXiv cs.LG ↗ · 2026-05-14 Cached

The paper proposes Slice, a gradient-surgery-based initialization for LoRA adapters in continual learning that reconciles conflicting gradients from current and past tasks to reduce catastrophic forgetting, achieving better stability-plasticity trade-offs.

0 favorites 0 likes
← Back to home

Submit Feedback