AI Slop and Hallucinations in Vulnerability Assessment: A Survey on Reasoning Failures and Trustworthy Mitigation
تستقصي هذه الدراسة أزمة الموثوقية في تقييم الثغرات الأمنية المدفوع بالذكاء الاصطناعي والناجمة عن "الحشو الناتج عن الذكاء الاصطناعي" (AI slop) والهلوسة، محاججةً بأن سد الفجوة بين التوليد الاحتمالي للنماذج اللغوية الكبيرة والاستنتاج الاستنباطي الخبير يتطلب الانتقال من الكشف السلبي إلى التحقق العصبي الرمزي النشط وإدخال مقاييس تقييم قابلة للتحقق رياضياً مثل CVE-Bench وSlop-Score.