Blind Spots in the Guard: How Domain-Camouflaged Injection Attacks Evade Detection in Multi-Agent LLM Systems
本論文は、マルチエージェント LLM システムにおけるインジェクション検出器が、ドメイン固有の語彙や権威構造を模倣する攻撃を特定できず、検出率が急落し、安全性メカニズムにおける重大なアーキテクチャ的脆弱性を露呈させる「カモフラージュ検出ギャップ」に深刻に悩まされていることを明らかにしている。