lora-finetuning

Tag

Cards List
#lora-finetuning

LayerRoute: Adaptive Layer-Skipping with LoRA-Preserved Quality for Efficient LLM Inference

arXiv cs.CL · 2026-09-15 Cached

LayerRoute introduces a parameter-efficient method for adaptive transformer layer-skipping that combines per-layer routing with joint LoRA fine-tuning, achieving verified speedups and quality improvements in LLM inference.

0 favorites 0 likes
← Back to home

Submit Feedback