💻 computer science

Relevance as a Vulnerability: How Web Retrieval Degrades Safety Alignment in LLM Agents

यह शोधपत्र AgentREVEAL फ्रेमवर्क और HarmURLBench को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि LLM एजेंटों में वेब रिट्रीवल (web retrieval), सिंगल-स्टेप इंटीग्रेशन और "सेफ सोर्स पैराडॉक्स" (Safe Source Paradox) दोनों के माध्यम से हानिकारक अनुपालन (harmful compliance) को बढ़ाकर सुरक्षा संरेखण (safety alignment) को कम करता है, जो एक मौलिक सुरक्षा-उपयोगिता ट्रेड-ऑफ (safety-utility trade-off) को उजागर करता है जहाँ वही प्रासंगिकता जो रिट्रीवल को उपयोगी बनाती है, एक भेद्यता (vulnerability) के रूप में भी कार्य करती है।

Aditya Nawal, Manit Baser, Mohan Gurusamy2026-05-29
🤖 AI

BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents

यह शोधपत्र BenchTrace प्रस्तुत करता है, जो एक नया बेंचमार्क और मीट्रिक (Failure Avoidance Rate) है जिसे LLM एजेंटों की रिफ्लेक्शन गुणवत्ता और नियंत्रित विकास क्षमताओं का कठोरता से मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि वर्तमान मॉडल विफलता निदान (failure diagnosis) में संघर्ष करते हैं, सबक भूलने (lesson forgetting) से ग्रस्त होते हैं, और विशिष्ट संदर्भों से परे रिफ्लेक्शन को सामान्यीकृत करने में विफल रहते हैं।

Jiahao Huang, Fei Cheng, Junfeng Jiang, Zefan Yu, Akiko Aizawa2026-05-29
🤖 AI

Tailoring the Curriculum: Student-Centered Reasoning Distillation via Dynamic Data-Model Compatibility

यह शोध पत्र डेटा-मॉडल अनुकूलता (DMC) मीट्रिक को पेश करता है ताकि छात्र मॉडल की क्षमताओं के साथ इसके संरेखण के आधार पर प्रशिक्षण डेटा का आकलन और गतिशील रूप से चयन किया जा सके, जिससे विभिन्न मॉडलों और कार्यों में रीजनिंग डिस्टिलेशन प्रदर्शन में महत्वपूर्ण सुधार होता है।

Jiahao Huang, Fei Cheng, Junfeng Jiang, Akiko Aizawa2026-05-29
🤖 machine learning

BlockBatch: Multi-Scale Consensus Decoding for Efficient Diffusion Language Model Inference

BlockBatch एक ट्रेनिंग-फ्री इन्फरेंस फ्रेमवर्क है जो कई ब्लॉक-साइज शाखाओं को समानांतर में निष्पादित करके और उन्हें कॉन्फिडेंस-गेटेड सिंक्रोनाइज़ेशन के माध्यम से मर्ज करके डिफ्यूजन लैंग्वेज मॉडल्स को तेज़ करता है, जिससे सटीकता से समझौता किए बिना डिनोइजिंग स्टेप्स और एंड-टू-एंड स्पीड में सुधार होता है।

Xiaoyou Wu (Celine), Cheng-Jhih Shih (Celine), Binfei Ji (Celine), Yong Liu (Celine), Yingyan (Celine), Lin2026-05-29
🤖 AI

Rethinking Literature Search Evaluation: Deep Research Helps, and Human Citation Lists Are Not a Ground Truth

यह शोध पत्र प्रदर्शित करता है कि एक डीप रिसर्च पाइपलाइन साहित्य खोज की रिकॉल (recall) में महत्वपूर्ण सुधार करती है और साथ ही यह भी प्रकट करती है कि मानव उद्धरण सूचियाँ सहयोगियों के प्रति पक्षपाती होती हैं और इस प्रकार एकमात्र ग्राउंड ट्रुथ (ground truth) के रूप में अपर्याप्त हैं, जो एक बहु-आयामी मूल्यांकन ढांचे की वकालत करता है जो रिकॉल, प्रासंगिकता, विविधता और सह-लेखक दूरी को जोड़ता है।

Gaurav Sahu, Laurent Charlin, Christopher Pal2026-05-29
🤖 AI

Surfacing Isolated Learners with Outcome-Independent Mediation of Feedback between Teachers and Students Using AI

यह शोध पत्र एक व्याख्या योग्य, एआई-संचालित निर्णय परत का प्रस्ताव करता है जो ग्रेड-आधारित परिणामों पर निर्भर रहने के बजाय छात्र स्व-रिपोर्ट, देखी गई कठिनाइयों और शिक्षक की चिंताओं को एकीकृत करके अलग-थलग पड़े शिक्षार्थियों की पहचान करता है और पाठ्यक्रम विषयों को प्राथमिकता देता है, जो एक स्नातक सीएस पाठ्यक्रम में प्रशिक्षक अंतर्दृष्टि के साथ संरेखित होने और जोखिम वाले छात्रों को सामने लाने में अपनी प्रभावशीलता प्रदर्शित करता है।

Junsoo Park, Youssef Medhat, Htet Phyo Wai, Ploy Thajchayapong, Ashok K. Goel2026-05-29
💻 computer science

Wait! There's a Way Out: A Decision Mechanism for Forecasting Conversational Derailment

यह शोध पत्र संवादात्मक विचलन (कन्वर्सेशनल डेरेलमेंट) के पूर्वानुमान के लिए एक नवीन निर्णय तंत्र प्रस्तावित करता है जो भविष्योन्मुखी सिमुलेशन का उपयोग करके अलर्ट ट्रिगरिंग को संभावना अनुमान से अलग करता है ताकि तब तक अलर्ट को स्थगित किया जा सके जब तक कि सुधार की संभावना हो, जिससे सटीकता से समझौता किए बिना गलत सकारात्मक परिणामों (फॉल्स पॉजिटिव्स) को काफी कम किया जा सके।

Laerdon Kim, Vivian Nguyen, Cristian Danescu-Niculescu-Mizil2026-05-29
🤖 AI

Provably Secure Agent Guardrail

यह शोध पत्र AI एजेंटों के लिए एक नया सुरक्षा प्रतिमान प्रस्तावित करता है जिसे 'एग्जीक्यूटेबल प्रूफ-कंस्ट्रेंड एक्शन' (ePCA) फ्रेमवर्क कहा जाता है, जो एक न्यूरल सिम्बोलिक आइसोलेशन आर्किटेक्चर का उपयोग करता है ताकि एजेंटों को निष्पादन से पहले अपने इरादों को फर्स्ट-ऑर्डर लॉजिकल कंस्ट्रेंट्स में औपचारिक रूप देने के लिए बाध्य किया जा सके, जिससे शून्य हमले की सफलता दर और शून्य फॉल्स पॉजिटिव दर के साथ सिमेंटिक हमलों के विरुद्ध प्रमाणित रूप से सुरक्षित, नियत रक्षा प्राप्त की जा सके।

Benlong Wu, Weiming Zhang, Kejiang Chen, Han Fang, Nenghai Yu2026-05-29
🤖 machine learning

KLAS: Using Similarity to Stitch Neural Networks for Improved Accuracy-Efficiency Tradeoffs

यह शोध पत्र KLAS को प्रस्तुत करता है, जो एक नवीन फ्रेमवर्क है जो सबसे समान मध्यवर्ती निरूपणों (intermediate representations) की पहचान करने के लिए KL डाइवर्जेंस का लाभ उठाकर प्रीट्रेंड न्यूरल नेटवर्क की स्टिचिंग को स्वचालित और अनुकूलित करता है, जिससे मौजूदा ह्यूरिस्टिक-आधारित दृष्टिकोणों की तुलना में सटीकता-दक्षता ट्रेड-ऑफ में महत्वपूर्ण सुधार होता है।

Debopam Sanyal, Anantharaman Iyer, Alind Khare, Trisha Jain, Akshay Jajoo, Myungjin Lee, Clayton Kerce, Alexey Tumanov2026-05-29
🤖 AI

Harmonizing Real-Time Constraints and Long-Horizon Reasoning: An Asynchronous Agentic Framework for Dynamic Scheduling

RACE-Sched एक एसिंक्रोनस एजेंट-आधारित फ्रेमवर्क है जो तत्काल डिस्पैचिंग के लिए लो-लेटेंसी सिम्बोलिक ह्यूरिस्टिक्स को समानांतर LLM-संचालित विमर्श से अलग करके, जो इन नियमों को संश्लेषित और सुरक्षित रूप से विकसित करता है, गतिशील जॉब शॉप शेड्यूलिंग में वास्तविक समय की बाधाओं और लॉन्ग-होरिज़न रीजनिंग के बीच के संघर्ष को हल करता है।

Shijie Cao, Yuan Yuan, Jing Liu2026-05-29