BitTide
首页
最新
模型
工具
新闻
产品
论文
事件
今日日报
搜索
订阅
English
登录
mixed-precision-quantization
标签
Cards
List
#mixed-precision-quantization
用于大语言模型压缩的联合结构化剪枝与混合精度量化
arXiv cs.AI
↗
· 2026-06-09
缓存
一种新颖的端到端大语言模型压缩框架,联合优化结构化剪枝与混合精度量化,在超低位宽精度下,相比于现有最先进方法实现了显著的困惑度降低和加速效果。
0 人收藏
0 人点赞
← 返回首页
意见反馈
×
提交意见反馈
感谢您的反馈!
提交