Domain-Filtered Knowledge Graphs from Sparse Autoencoder Features
DGX agentarXiv:2604.23829v1 Announce Type: new Abstract: Sparse autoencoders (SAEs) extract millions of interpretable features from a language model, but flat feature inventories aren't very useful on their ow