sae-families

Tag

Cards List
#sae-families

Are Single-Token Sparse Autoencoder Features Causally Necessary? Layer-Depth and SAE-Family Effects

arXiv cs.LG · 2026-07-24 Cached

This paper investigates whether single-token sparse autoencoder features are causally necessary for model outputs, finding that causal roles vary across SAE families and are sensitive to training methodology rather than activation function or scale.

0 favorites 0 likes
← Back to home

Submit Feedback