Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models
Qwen-RobotManip एक सामान्यीकरण योग्य विजन-लैंग्वेज-एक्शन फाउंडेशन मॉडल है जो प्रतिनिधित्व, गति और व्यवहार संबंधी आयामों में एक एकीकृत संरेखण ढांचे का लाभ उठाता है ताकि लगभग 38,100 घंटों के ओपन-सोर्स कॉर्पस पर बड़े पैमाने पर प्रशिक्षण सक्षम किया जा सके, जिससे विविध रोबोटिक प्लेटफॉर्म और आउट-ऑफ-डिस्ट्रीब्यूशन बेंचमार्क में अत्याधुनिक प्रदर्शन और उभरती हुई सामान्यीकरण क्षमताएं प्राप्त होती हैं।