Ask, Condition or Abstain: Reinforcement Learning for Missing-Premise Reasoning
تقدم هذه الورقة إطار عمل التعلم المعزز ACA-RL ومعيار Missing-Premise Benchmark (MPB) اللذين يمكّنان نماذج الاستدلال من التعامل بفعالية مع الاستعلامات غير محددة المعالم عبر تعلم طلب المعلومات المفقودة، أو ربط الإجابات بالمجاهيل، أو الامتناع عن الإجابة، بدلاً من فرض استجابات غير صحيحة.