💬 NLP

AgentRedBench: Dynamic Redteaming and Integration-Aware Defense for LLM Agents over SaaS Integrations

यह शोध पत्र AgentRedBench प्रस्तुत करता है, जो अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन (indirect prompt injection) के प्रति LLM एजेंटों की उच्च संवेदनशीलता को उजागर करने के लिए 24 एंटरप्राइज SaaS एकीकरणों में 215 परिदृश्यों को कवर करने वाला एक गतिशील रेडटीमिंग बेंचमार्क है, और AgentRedGuard प्रस्तुत करता है, जो एक विशेष रक्षा मॉडल है जो कम फॉल्स-पॉजिटिव दर बनाए रखते हुए हमले की सफलता दर को लगभग 70% से घटाकर 2.4% कर देता है।

Hiskias Dingeto, Will Leeney2026-06-02
💬 NLP

Geometric Latent Reasoning Induces Shorter Generations in LLMs

यह शोध पत्र ज्योमेट्रिक लेटेंट रीजनिंग (GLR) को प्रस्तुत करता है, जो तर्क प्रक्रिया को एम्बेडिंग स्पेस में एक ज्यामितीय पथ-अनुमान समस्या के रूप में सूत्रबद्ध करता है, जिससे LLMs को शुरुआती स्पष्ट तर्क चरणों के स्थान पर निरंतर लेटेंट ट्रांज़िशन का उपयोग करके काफी छोटे जनरेशन के साथ सही उत्तर प्राप्त करने में सक्षम बनाया जा सके।

Shashi Kumar, Yacouba Kaloga, Petr Motlicek, Ina Kodrasi, Andrea Cavallaro2026-06-02
💬 NLP

Cross-modal linkage risk in clinical vision-language models

यह शोध पत्र यह प्रदर्शित करता है कि विशिष्ट क्लिनिकल विजन-लैंग्वेज मॉडल क्रॉस-मोडल रिट्रीवल के माध्यम से वि-पहचानीकृत (de-identified) चेस्ट रेडियोग्राफ को उनकी मूल रिपोर्टों से पुनः जोड़ने में सक्षम बनाकर एक महत्वपूर्ण गोपनीयता जोखिम उत्पन्न करते हैं, और अलाइनमेंट लेयर के लक्षित डिफरेंशियल प्राइवेट फाइन-ट्यूनिंग का प्रस्ताव करता है जो मॉडल की नैदानिक उपयोगिता को बनाए रखते हुए इस पुन: जुड़ाव जोखिम को काफी कम कर देता है।

Soroosh Tayebi Arasteh, Mahshad Lotfinia, Sven Nebelung, Daniel Truhn2026-06-02
💬 NLP

DECK: A Consistency x Confidence Taxonomy of LLM Hallucinations

यह शोध पत्र DECK को प्रस्तुत करता है, जो एक नवीन 2x2 वर्गीकरण है जो इंटर-सैंपल निरंतरता (inter-sample consistency) और टोकन-स्तर के आत्मविश्वास (token-level confidence) के आधार पर डिटेकेबिलिटी सिग्नेचर (detectability signatures) के माध्यम से LLM मतिभ्रम (hallucinations) को वर्गीकृत करता है, जो यह प्रकट करता है कि विशिष्ट त्रुटि प्रकारों (ड्रिफ्ट, एंट्रेंच्ड, कॉन्फैबुलेशन, नॉटेड) के लिए अलग-अलग पहचान विधियों की आवश्यकता होती है और एक सार्वभौमिक ब्लाइंड स्पॉट को उजागर करता है जहाँ ज्ञान-अंतराल (knowledge-gap) वाले इनपुट्स पर आत्मविश्वासी, दोहराव वाली मनगढ़ंत रचनाएँ वर्तमान आउटपुट-स्तर के अनिश्चितता परिमाणीकरण (uncertainty quantification) दृष्टिकोणों द्वारा अनिरोध्य रहती हैं।

Mohit Singh Chauhan2026-06-02✓ Author reviewed
💬 NLP

AI as a Tool for Simulation-Based Experiments in Literary Studies

यह शोध पत्र साहित्यिक अध्ययन में सांस्कृतिक उत्पादन के बड़े पैमाने पर, नियंत्रित सिमुलेशन (simulations) आयोजित करने के लिए जनरेटिव एआई (generative AI) के उपयोग की क्षमता का अन्वेषण करता है, जो वर्तमान तकनीकी क्षमताओं और चुनौतियों को रेखांकित करते हुए प्रारंभिक प्रयोगात्मक परिणाम प्रस्तुत करता है जो मानव-लिखित उपन्यासों के तुलनीय सीमित इन-डिस्ट्रीब्यूशन (in-distribution) टेक्स्ट जनरेशन को प्रदर्शित करते हैं।

Matthew Wilkens2026-06-02
💬 NLP

Beyond Isolated Behaviors: Hierarchical User Modeling for LLM Personalization

यह शोध पत्र PHF प्रस्तुत करता है, जो कि बौर्दियू के 'थ्योरी ऑफ प्रैक्टिस' से प्रेरित एक समाजशास्त्रीय रूप से आधारित ढांचा है, जो अभ्यासों (practices), हेबिटस (habitus) और क्षेत्रों (fields) की एक पदानुक्रमित संरचना के माध्यम से उपयोगकर्ता डेटा को मॉडल करके LLM वैयक्तिकरण को बढ़ाता है, और LaMP बेंचमार्क पर निरंतर प्रदर्शन सुधार प्राप्त करता है।

Liang Wang, Xinyi Mou, Xiaoyou Liu, Tiannan Wang, Yuqing Wang, Zhongyu Wei2026-06-02
💬 NLP

Unified Context Evolution for LLM Agents

यह शोधपत्र यूनिफाइड कॉन्टेक्स्ट इवोल्यूशन (UCE) प्रस्तुत करता है, जो एक ग्रेडिएंट-मुक्त फ्रेमवर्क है जो 'इवॉलेबल कॉन्टेक्स्ट यूनिट्स' के एक गतिशील, टाइप किए गए लाइब्रेरी में अनुभव को बाह्य रूप से संचित करके LLM एजेंटों को बेहतर बनाता है, जिन्हें निरंतर प्रदर्शन और विभिन्न बैकबोन के बीच स्थानांतरण में सुधार करने के लिए चयनात्मक रूप से जनरेट, स्कोर और प्रून किया जाता है।

Zixuan Zhu, Yitong Hu, Yong Dai, Junfeng Fang, Chunyang Jiang, Senkang Hu, Yuzhi Zhao2026-06-02
🤖 AI

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses

हार्नेस-1 (Harness-1) एक 20B सुदृढीकरण लर्निंग-आधारित (reinforcement learning-based) खोज एजेंट है जो मौजूदा ओपन और फ्रंटियर मॉडलों की तुलना में बेहतर रिट्रीवल प्रदर्शन और विविध बेंचमार्क में मजबूत सामान्यीकरण प्राप्त करने के लिए, अर्थपूर्ण निर्णय लेने की क्षमता को बरकरार रखते हुए नियमित स्टेट मैनेजमेंट को एक बाहरी स्टेटफुल हार्नेस पर ऑफलोड करता है।

Pengcheng Jiang, Zhiyi Shi, Kelly Hong, Xueqiang Xu, Jiashuo Sun, Jimeng Sun, Hammad Bashir, Jiawei Han2026-06-02
💬 NLP

WAXAL-NET: Finetuned Edge ASR Across 19 African Languages

यह शोध पत्र प्रदर्शित करता है कि WAXAL कॉर्पस पर फाइन-ट्यून किए गए कॉम्पैक्ट, डोमेन-विशिष्ट ASR मॉडल 19 अफ्रीकी भाषाओं में बड़े मल्टीलिंगुअल फाउंडेशन मॉडल्स की तुलना में काफी बेहतर प्रदर्शन करते हैं, और साथ ही अफ्रीकी स्पीच रिकग्निशन रिसर्च को आगे बढ़ाने के लिए एक भाषाई रूप से आधारित त्रुटि विश्लेषण और व्यापक संसाधन भी प्रदान करते हैं।

Victor Tolulope Olufemi, Oreoluwa Babatunde, Ramsey Njema, Bolarinwa Gbotemi, Wanchi Lucia Yen, John Uzodinma, Sunday Aj (…)2026-06-02
💬 NLP

A Local Perturbation Theory for Cross-Domain Interference and Recovery in Multi-Domain RL

यह शोध पत्र एक स्थानीय विक्षोभ सिद्धांत (local perturbation theory) प्रस्तावित करता है जो यह स्पष्ट करता है कि मल्टी-डोमेन आरएल (multi-domain RL) में क्रॉस-डोमेन हस्तक्षेप एक निम्न-आयामी साझा संघर्ष उप-स्थान (low-dimensional shared conflict subspace) के भीतर द्वितीय-क्रम की क्षति (second-order damage) से उत्पन्न होता है, जो यह प्रदर्शित करता है कि लक्षित डोमेन रिफ्रेश या प्रशिक्षण-मुक्त रोलबैक अन्य क्षमताओं को संरक्षित करते हुए निम्नीकृत प्रदर्शन को चुनिंदा रूप से पुनः प्राप्त कर सकते हैं।

Lei Yang, Siyu Ding, Deyi Xiong2026-06-02