WinDOM: Self-Family Distillation for Small-Model GUI Grounding
WinDOM एक स्व-पर्यवेक्षित (self-supervised) ढांचे को पेश करता है जो छोटे GUI-ग्राउंडिंग एजेंटों के लिए एक DOM-हार्वेस्टेड प्रशिक्षण संग्रह को सेल्फ-फैमिली डिस्टिलेशन और सुदृढीकरण लर्निंग (Reinforcement Learning) के साथ जोड़ता है, जो यह प्रदर्शित करता है कि एक कम-संतृप्त कोल्ड-स्टार्ट इनिशियलाइज़ेशन बाहरी शिक्षकों या मानव एनोटेशन की आवश्यकता के बिना छोटे मॉडलों के प्रदर्शन को महत्वपूर्ण रूप से बढ़ाता है।