mixed-precision-quantization

标签

Cards List
#mixed-precision-quantization

用于大语言模型压缩的联合结构化剪枝与混合精度量化

arXiv cs.AI · 2026-06-09 缓存

一种新颖的端到端大语言模型压缩框架,联合优化结构化剪枝与混合精度量化,在超低位宽精度下,相比于现有最先进方法实现了显著的困惑度降低和加速效果。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈