Object Hallucination-Free Reinforcement Unlearning for Vision-Language Models
تقترح هذه الورقة إطار عمل HFRU، وهو إطار لنسيان التعزيز يعمل على مشفر الرؤية باستخدام تحسين قائم على GRPO ومكافأة تجريد لتحقيق نسيان دلالي عميق للمعرفة الحساسة في نماذج الرؤية واللغة مع منع هلوسة الأشياء بفعالية.