Beyond Handcrafted Security: Towards Self-Evolving Defense for LLM Agents
تقدم هذه الورقة إطار عمل HARD، وهو إطار دفاعي ذاتي التطور يعمل أثناء وقت التشغيل، يقوم بأتمتة تحديد وتحسين التدخلات الأمنية بشكل تكراري لوكلاء النماذج اللغوية الكبيرة (LLM agents)، مما يتغلب على قيود الدفاعات اليدوية المصنوعة يدويًا مع الحفاظ على فائدة المهام.