Discovering Reinforcement Learning Interfaces with Large Language Models
تقدم هذه الورقة LIMEN، وهو إطار عمل تطوري موجه بنماذج لغوية كبيرة يقوم تلقائياً بتخليق واجهات مهام تعلم تعزيزي كاملة — بما في ذلك خرائط الملاحظات ودوال المكافأة — من حالات المحاكي الخام ومقاييس النجاح على مستوى المسار، مما يثبت أن التحسين المشترك لهذه المكونات أمر ضروري للنجاح عبر مجالات متنوعة.