One for All: A Non-Linear Transformer can Enable Cross-Domain Generalization for In-Context Reinforcement Learning
यह शोध पत्र प्रस्तावित करता है कि नॉन-लीनियर ट्रांसफॉर्मर्स, एक साझा रिप्रोड्यूसिंग कर्नेल हिल्बर्ट स्पेस के भीतर विविध वैल्यू फंक्शन्स को दर्शाने वाले कर्नेल-आधारित टेम्पोरल डिफरेंस लर्नर्स के रूप में कार्य करके, इन-कॉन्टेक्स्ट रीइन्फोर्समेंट लर्निंग में क्रॉस-डोमेन जनरलाइजेशन प्राप्त कर सकते हैं।