Mechanistic Interpretability and Causal Feature Steering of Neural Quantum States via Sparse Autoencoders
Dit artikel toont aan dat sparse autoencoders ongesuperviseerde, causale interne kenmerken in Neural Quantum States kunnen ontdekken die direct corresponderen met fysieke observabelen, wat gerichte interventie mogelijk maakt om deze eigenschappen te sturen zonder de variationele energie te compromitteren.