@_shruti_joshi_: 今天来我们的海报@UncertaintyInAI 聊聊组合泛化、稀疏编码,以及如何改进现有的S…
摘要
Shruti Joshi 邀请参会者到 UncertaintyInAI 参加海报会议,讨论改进 Sparse Autoencoder (SAE) 架构以实现更好分布外泛化的研究。
今天来我们的海报@UncertaintyInAI 聊聊组合泛化、稀疏编码,以及如何让现有的SAE架构在OOD泛化方面做得更好。
查看缓存全文
缓存时间: 2026/08/20 19:03
今日欢迎莅临我们的海报展位 @UncertaintyInAI,共同探讨组合泛化、稀疏编码,以及如何优化现有稀疏自编码器架构以提升分布外泛化能力
如何可靠度量表征是否捕获了潜在因子?现有的可辨识性指标能否评估可解释性或无监督机制发现能力?
我们的UAI 2026研究论文揭示了这些评估中存在的系统性误报与漏报问题
相似文章
@TamazGadaev:第10天/n(面向AI研究人员的基础文本系列——并非特指论文,而是那些能让你掌握实际进行AI研究方法的作品)
Elhage等人的《叠加的玩具模型》解释了可解释性为何困难:模型通过叠加来用少于特征维度的方式表示更多特征,导致多语义神经元作为压缩手段出现。这篇论文催生了稀疏自编码器的研究计划。
@adiba_ejaz: 因果(和统计)模型如何泛化到相互作用对象的新颖组合?我们与 @eliasbare… 的工作
这篇在ICML上发表的论文探讨了因果和统计模型如何泛化到相互作用对象的新颖组合,并在会议期间安排了一场海报展示。
用于可解释性分布外检测的稀疏自编码器
本文介绍了一种新颖的方法,利用稀疏自编码器(SAEs)从网络中间激活中学习可解释特征,用于分布外(OOD)检测,该方法达到了最先进的性能,并提供了关于分布偏移如何影响所学表示的见解。
WriteSAE:面向循环状态的稀疏自编码器
WriteSAE 引入了第一个稀疏自编码器,能够分解状态空间模型和混合循环语言模型中的矩阵缓存写入,相比现有方法实现了更优的令牌级干预。
@carolineschoi:我今天会在A厅的海报展示区,时间是韩国标准时间下午5点到7点45分。如果你想聊聊合成数据、自博弈或……欢迎来打个招呼!
提出锚定自博弈(ASP)方法,通过生成器-修复器自博弈,结合嵌入相似度奖励和参考错误混合,来扩展代码修复监督,在全新基准测试BugSourceBench上,相较于标准自博弈,修复率相对提升24%。