The Hive Mind is a Single Reinforcement Learning Agent
यह शोध पत्र यह स्थापित करता है कि विशुद्ध रूप से अनुकरण करने वाले एजेंटों के झुंड, जैसे कि मधुमक्खियाँ, का उभरता हुआ "हाइव माइंड" (सामूहिक मस्तिष्क), सामूहिक निर्णय लेने को अनुकूलित करने के लिए "मेइनार्ड-क्रॉस लर्निंग" नामक एक नवीन मल्टी-आर्म्ड बैंडिट एल्गोरिदम का उपयोग करने वाले एक एकल ऑनलाइन सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) एजेंट के गणितीय रूप से समकक्ष है।