quantization-vulnerability

标签

Cards List
#quantization-vulnerability

推理感知压缩:识别并保护脆弱推理电路以实现能效LLM部署

arXiv cs.AI ↗ · 2026-09-10 缓存

本文提出了一种推理感知压缩框架,用于识别和保护大型推理模型中的脆弱推理电路,以提高能效,实现了优于均匀量化方法的帕累托最优性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈