BoostAPR: Boosting Automated Program Repair via Execution-Grounded Reinforcement Learning with Dual Reward Models
يُعد BoostAPR إطار عمل ثلاثي المراحل يعزز إصلاح البرامج الآلي من خلال الجمع بين الضبط الدقيق الخاضع للإشراف والاستدلال المتحقق منه عبر التنفيذ ونماذج المكافأة المزدوجة لتمكين تخصيص الائتمان الدقيق على مستوى السطر أثناء التعلم المعزز، محققاً أداءً هو الأفضل في فئته وقدرة قوية على التعميم عبر اللغات في مختلف معايير القياس.