Revisiting Parameter Redundancy in Vision-Language-Action Models: Insights from VLM-to-VLA Adaptation
यह शोध पत्र इस धारणा को चुनौती देता है कि विजन-लैंग्वेज-एक्शन (VLA) मॉडलों में पैरामीटर रेडंडेंसी (parameter redundancy) समान होती है, और VLM-से-VLA अनुकूलन के दौरान संरचित विचलन पैटर्न (structured divergence patterns) को प्रकट करते हुए एक नवीन मल्टी-मॉड्यूल जॉइंट प्रूनिंग रणनीति प्रस्तुत करता है जो बिना किसी पोस्ट-प्रूनिंग रिकवरी की आवश्यकता के मूल प्रदर्शन का 90% बनाए रखते हुए महत्वपूर्ण पैरामीटर कमी (12%–30%) प्राप्त करता है।