Enhancing Table Reasoning with Deterministic Table-State Rewards
تقدم هذه الورقة TABROUGE، وهو مقياس مكافأة حتمي لا يتطلب تدريباً يعتمد على أطول سلسلة فرعية مشتركة، وإطار عمل RE-TAB لتعزيز دقة استدلال النماذج اللغوية الكبيرة على الجداول متعدد الخطوات بشكل كبير من خلال توفير تغذية راجعة قابلة للتوسع ومستندة إلى الاستعلام للحالات المتوسطة دون الاعتماد على نماذج متعلمة أو منفذين خارجيين.