TAPR: Enhancing LLM Performance with a Task-Aware Prompt Rewriter
تقدم هذه الورقة البحثية TAPR، وهو مُعيد صياغة للمطالبات مدرك للمهام (Task-Aware Prompt Rewriter) تم تدريبه عبر تحسين السياسة النسبي المجموعي (Group Relative Policy Optimization)، والذي يعمل على إعادة صياغة مدخلات المستخدم إلى مطالبات محسنة، مما يعزز بشكل كبير أداء النماذج اللغوية الكبيرة (LLMs) في مهام مثل الإجابة على الأسئلة والاستدلال الحسابي.