减少模型参数大小?
摘要
讨论减少模型参数大小的方法或研究,可能侧重于剪枝或量化等技术以提高效率。
暂无内容
相似文章
超越 FP16 + ONNX 的 Transformer 体积与推理优化(剪枝/图优化收效甚微)[P]
作者分享在 162 MB Transformer 上把 FP16 + ONNX + 剪枝用到极致却收益递减的经历,求教下一步该选量化、蒸馏、低秩分解还是硬件级技巧。
SlimQwen:探索大规模MoE模型预训练中的剪枝与蒸馏
本文探讨了在预训练阶段压缩大规模混合专家(MoE)模型的结构化剪枝和知识蒸馏技术。研究表明,渐进式剪枝以及结合多标记预测蒸馏等策略,能够提升下游任务的性能。例如,通过将Qwen3-Next-80A3B压缩为更高效的23A2B模型,展示了这一方法的有效性。
参数高尔夫:什么真正有效?
一篇论文分析了在严格的大小和时间限制下训练语言模型的参数高尔夫开放挑战,发现单个技术很少能将BPB提高超过1%,但总体上实现了13.6%的降低。
[论文] 大语言模型的统计无损量化
本文提出了一种针对大语言模型的统计无损量化方法,旨在在不损失信息的情况下减小模型大小。
重新思考小型VLM量化:从组件分析到硬件感知的边缘部署
本文系统性地评估了Jetson边缘设备上小型视觉语言模型的组件级量化,发现模型架构(MoE vs 稠密)显著影响量化敏感性,且量化误差在大体上是累加的,除了模态对齐路径之外。