Teacher-Aware Evolution of Heuristic Programs from Learned Optimization Policies
تقترح هذه الورقة إطار عمل تطوريًا مدركًا للمعلم يستفيد من سياسات التحسين المتعلمة والمدربة بشكل مستقل كمعلمين سلوكيين لتوجيه الاكتشاف التلقائي للاستدلالات الثابتة والقابلة للتنفيذ للمسائل التوافقية، محققًا أداءً متفوقًا على النماذج اللغوية الكبيرة المرجعية القائمة على الأداء الصرف دون الحاجة إلى الاستدلال العصبي عند التشغيل.