Semantic Attacks on Tool-Augmented LLMs: Securing the Model Context Protocol Against Descriptor-Level Manipulation
تحدد هذه الورقة وتصيغ ثلاثة ناقلات هجوم دلالية جديدة على مستوى الوصف (تسميم الأدوات، والتظليل، وسحب البساط) ضد بروتوكول سياق النموذج (MCP)، موضحةً أن التلاعب بالبيانات الوصفية للأدوات يمكن أن يخل بشكل كبير بسلامة النماذج اللغوية الكبيرة، وتقترح استراتيجية دفاع متعددة الطبقات تقلل بفعالية من استدعاءات الأدوات غير الآمنة دون الحاجة إلى إعادة تدريب النموذج.