Adversarial Feeds Steer LLM Agent Decisions Against Their Defaults
यह शोध पत्र यह प्रदर्शित करता है कि बाहरी सूचना फीड का क्यूरेशन और क्रमबद्धता एलएलएम (LLM) एजेंटों को व्यवस्थित रूप से प्रतिकूल निर्णयों की ओर मोड़ सकती है, विशेष रूप से तब जब वे अनिश्चित होते हैं, जो यह प्रकट करता है कि सुरक्षा मूल्यांकनों को मॉडल का अलग से परीक्षण करने के बजाय अपस्ट्रीम अनुशंसाअर (recommender) परत का ऑडिट करना चाहिए।