rl-triton: High-Performance Triton GPU Kernels for Reinforcement Learning Credit Assignment
تقدم هذه الورقة البحثية rl-triton، وهي مكتبة مفتوحة المصدر تستفيد من إطار عمل مسح ترابطي موحد مُنفذ في Triton لتسريع سبعة خوارزميات متميزة لتعيين الائتمان في التعلم التعزيزي على وحدات معالجة الرسومات، محققةً تسريعات تتراوح بين 1.6 و5.70 ضعفاً مقارنة بالنماذج المرجعية المتجهة عن طريق تقليل عبء الذاكرة وتمكين الحوسبة المتوازية بمقياس .