Insider Attacks in Multi-Agent LLM Consensus Systems
تتقصى هذه الورقة الهجمات الداخلية في أنظمة إجماع النماذج اللغوية الكبيرة متعددة الوكلاء من خلال اقتراح إطار عمل قائم على نموذج عالمي يستخدم التعلم التعزيزي لتدريب وكيل خبيث على تأخير أو منع الاتفاق بين الوكلاء الحميدين بشكل فعال.