Dynamic Plasma Shape Control with Arbitrary Sensor Subsets
Este artigo apresenta um agente de aprendizado por reforço treinado em simulação de alta fidelidade que alcança controle robusto, zero-shot, da forma dinâmica do plasma em tokamaks, rastreando simultaneamente alvos arbitrários e tolerando falhas aleatórias de sensores de diagnóstico sem exigir controladores de backup ou lógica de comutação de modos.