Reinforcement Learning to Disentangle Multiqubit Quantum States from Partial Observations
This paper presents a deep reinforcement learning approach using a permutation-equivariant transformer architecture that, relying solely on local two-qubit reduced density matrices, autonomously constructs efficient and noise-resilient disentangling circuits for multiqubit states on NISQ devices, achieving optimal gate counts for arbitrary 4-qubit state preparation.