fisher-importance

Tag

Cards List
#fisher-importance

Less is MoE: Trimming Experts in Domain-Specialist Language Models

arXiv cs.LG · 2026-06-05 Cached

This paper introduces Fisher-MoE, a method that compresses Mixture-of-Experts models by trimming intermediate dimensions within FFN layers using Fisher importance, achieving 45% weight memory reduction and 21% throughput improvement without significant capability loss.

0 favorites 0 likes
← Back to home

Submit Feedback