RoboJailBench: Benchmarking Adversarial Attacks and Defenses in Embodied Robotic Agents
تقدم هذه الورقة RoboJailBench، وهو أول إطار تقييم معياري لهجمات كسر الحماية في أنظمة الذكاء الاصطناعي المتجسد، والذي يعالج الفجوات الحالية من خلال إنشاء تصنيف أمني، وإنشاء مسار بيانات لتباين النوايا، وتوفير مقاييس موحدة لتقييم المقايضة بين الأمان والمنفعة في نماذج الرؤية واللغة المتجسدة.