CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning
यह शोध पत्र CUDA-L1 प्रस्तुत करता है, जो एक कंट्रास्टिव रीइन्फोर्समेंट लर्निंग फ्रेमवर्क है जो शुरू में कम प्रदर्शन करने वाले LLM को एक अत्यधिक प्रभावी स्वचालित CUDA ऑप्टिमाइज़र में बदल देता है, जिससे बिना किसी मानवीय विशेषज्ञता की आवश्यकता के विविध बेंचमार्क और GPU आर्किटेक्चर में महत्वपूर्ण गति (speedups) प्राप्त होती है।