HERB: Human-augmented Efficient Reinforcement learning for Bin-packing
यह शोध पत्र HERB को प्रस्तुत करता है, जो एक मानव-संवर्धित सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो विविध 3D वस्तुओं को कुशलतापूर्वक और स्थिरता से पैक करने के लिए मानव प्रदर्शनों को RL अन्वेषण के साथ जोड़ता है, और दक्षता तथा वास्तविक दुनिया की रोबोटिक व्यवहार्यता दोनों में पारंपरिक ह्यूरिस्टिक्स और शुद्ध RL विधियों से बेहतर प्रदर्शन करता है।