Do Sparse Autoencoders Learn Meaningful Concept Hierarchies?
arXiv:2606.22994v1 Announce Type: new Abstract: Sparse autoencoders (SAEs) have become an important tool for unsupervised concept discovery in large models. To make the resulting feature spaces more i