weight-activation-quantization

Tag

Cards List
#weight-activation-quantization

Understanding LLM Quantization through Activation-Guided Compensation and Orthogonal Residuals

arXiv cs.LG ↗ · 3d ago Cached

This paper presents a decomposition framework for quantization error in large language models, separating it into activation-guided weight compensation and orthogonal residual, and derives practical guidelines for improving W4A4 quantization through techniques like Hadamard rotation and sign selection.

0 favorites 0 likes
← Back to home

Submit Feedback