One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context
यह शोध पत्र 'मल्टी-टास्क ऑन-पॉलिसी डिस्टिलेशन वाया सॉफ्ट-प्रॉम्ट प्रिविलेज्ड कॉन्टेक्स्ट' (Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context) प्रस्तुत करता है, जो एक ऐसी विधि है जो फ्रोजन बैकबोन मॉडल्स के साथ कार्य-विशिष्ट सीखने योग्य सॉफ्ट प्रॉम्ट्स को शिक्षकों के रूप में उपयोग करती है ताकि एक एकल स्टूडेंट मॉडल बिना कैटास्ट्रोफिक फॉरगेटिंग (catastrophic forgetting) से ग्रस्त हुए या पूर्ण वेट फाइन-ट्यूनिंग की आवश्यकता के बिना समानांतर में कई कार्यों से कुशलतापूर्वक ज्ञान आत्मसात कर सके।