@_shruti_joshi_: 今天来我们的海报@UncertaintyInAI 聊聊组合泛化、稀疏编码,以及如何改进现有的S…

X AI KOLs Timeline 事件

摘要

Shruti Joshi 邀请参会者到 UncertaintyInAI 参加海报会议,讨论改进 Sparse Autoencoder (SAE) 架构以实现更好分布外泛化的研究。

今天来我们的海报@UncertaintyInAI 聊聊组合泛化、稀疏编码,以及如何让现有的SAE架构在OOD泛化方面做得更好。
查看原文
查看缓存全文

缓存时间: 2026/08/20 19:03

今日欢迎莅临我们的海报展位 @UncertaintyInAI,共同探讨组合泛化、稀疏编码,以及如何优化现有稀疏自编码器架构以提升分布外泛化能力

如何可靠度量表征是否捕获了潜在因子?现有的可辨识性指标能否评估可解释性或无监督机制发现能力?

我们的UAI 2026研究论文揭示了这些评估中存在的系统性误报与漏报问题

相似文章

用于可解释性分布外检测的稀疏自编码器

arXiv cs.LG

本文介绍了一种新颖的方法,利用稀疏自编码器(SAEs)从网络中间激活中学习可解释特征,用于分布外(OOD)检测,该方法达到了最先进的性能,并提供了关于分布偏移如何影响所学表示的见解。

WriteSAE:面向循环状态的稀疏自编码器

Hugging Face Daily Papers

WriteSAE 引入了第一个稀疏自编码器,能够分解状态空间模型和混合循环语言模型中的矩阵缓存写入,相比现有方法实现了更优的令牌级干预。