Dynamic Plasma Shape Control with Arbitrary Sensor Subsets
यह शोध पत्र एक उच्च-सटीकता वाले सिमुलेशन में प्रशिक्षित एक सुदृढीकरण शिक्षण (reinforcement learning) एजेंट प्रस्तुत करता है जो बिना किसी बैकअप नियंत्रक या मोड-स्विचिंग लॉजिक की आवश्यकता के, यादृच्छिक डायग्नोस्टिक सेंसर विफलताओं को सहन करते हुए और साथ ही मनमाने लक्ष्यों को ट्रैक करते हुए, टोकामक में सुदृढ़, ज़ीरो-शॉट गतिशील प्लाज्मा आकार नियंत्रण प्राप्त करता है।