CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning
تقدم هذه الورقة البحثية CUDA-L1، وهو إطار عمل للتعلم التعزيزي التبايني يحول نموذج لغوي كبير قياسي إلى مُحسِّن CUDA آلي فعال قادر على تحقيق تسريع كبير عبر مختلف بنيات وحدات معالجة الرسومات والمقاييس المرجعية دون الحاجة إلى خبرة بشرية.