model-efficiency

标签

Cards List
#model-efficiency

大型视觉-语言模型在注意力机制中迷失

arXiv cs.AI · 2026-05-08 缓存

这篇研究论文利用信息论分析了大型视觉-语言模型(LVLM)的内部机制,揭示了注意力机制可能存在冗余,而前馈网络才是推动语义创新的关键。作者证明,将学习到的注意力权重替换为随机值仍可获得相当的性能,这表明当前模型“在注意力中迷失”。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈