🤖 AI

The Illusion of Multi-Agent Advantage

यह शोध पत्र यह प्रदर्शित करके मल्टी-एजेंट सिस्टम (MAS) की श्रेष्ठता में प्रचलित विश्वास को चुनौती देता है कि स्वचालित रूप से निर्मित MAS आर्किटेक्चर लगातार खराब प्रदर्शन करते हैं और सिंगल-एजेंट चेन-ऑफ-थॉट बेसलाइन की तुलना में काफी कम लागत-कुशल हैं, जो यह प्रकट करता है कि वर्तमान मूल्यांकन ढांचे महत्वपूर्ण आर्किटेक्चरल अक्षमताओं को छिपाते हैं और वास्तविक मल्टी-एजेंट लाभों को अनलॉक करने के लिए विशेषज्ञ-निर्मित प्रणालियाँ अभी भी आवश्यक हैं।

Prathyusha Jwalapuram, Hehai Lin, Chuyuan Li, Fangkai Jiao, Sudong Wang, Yifei Ming, Zixuan Ke, Chengwei Qin, Giuseppe C (…)2026-06-12
💬 NLP

NaturalFlow: Reducing Disruptive Pauses for Natural Speech Flow in Simultaneous Speech-to-Speech Translation

यह शोध पत्र NaturalFlow को प्रस्तुत करता है, जो एक प्रवाह-जागरूक (fluency-aware) अनुकूलन ढांचा है जो आंतरिक मॉडल संकेतों का लाभ उठाकर कम विलंबता (latency) और स्वाभाविक ध्वनिक प्रवाह के बीच संतुलन बनाकर समवर्ती स्पीच-टू-स्पीच अनुवाद में विघटनकारी ठहरावों को कम करता है, जिससे उच्च अनुवाद गुणवत्ता बनाए रखते हुए श्रोता के संज्ञानात्मक भार को न्यूनतम किया जा सके।

Dongwook Lee, Youngho Cho, Sangkwon Park, Heeseung Kim, Sungroh Yoon2026-06-12
💬 NLP

MiniPIC: Flexible Position-Independent Caching in <100LOC

MiniPIC एक न्यूनतम, लचीला vLLM डिज़ाइन है जो बार-बार आने वाले संरचित इनपुट्स के लिए कुशल स्थिति-स्वतंत्र (position-independent) कैशिंग को सक्षम बनाता है, जो अनरोटेटेड (unrotated) K वेक्टर्स को स्टोर करता है और अटेंशन के दौरान प्रति-अनुरोध पोजीशनल एनकोडिंग लागू करता है, जिससे 100 से कम कोर-इंजन परिवर्तनों के साथ महत्वपूर्ण थ्रूपुट और लेटेंसी सुधार प्राप्त होता है।

Nathan Ordonez (IBM Research), Thomas Parnell (IBM Research)2026-06-12
💬 NLP

Understanding helpfulness and harmless tension in reward models

यह शोध पत्र RLHF में रिवॉर्ड मॉडल्स के आंतरिक तंत्रों की जांच करता है, जो यह प्रकट करता है कि हेल्पफुलनेस (helpfulness) और हार्मलेसनेस (harmlessness) उद्देश्यों के बीच का हस्तक्षेप उन साझा न्यूरॉन्स से उत्पन्न होता है जो एक लक्ष्य का कारण से समर्थन करते हैं जबकि दूसरे को कमजोर करते हैं, जिससे यह स्पष्ट होता है कि मिश्रित-उद्देश्य वाले मॉडल अक्सर एकल-उद्देश्य वाले मॉडल्स की तुलना में खराब प्रदर्शन क्यों करते हैं।

Eshaan Tanwar, Pepa Atanasova2026-06-12
💬 NLP

Layer-Resolved Optimal Transport for Hallucination Detection in NMT and Abstractive Summarization

यह शोध पत्र न्यूरल मशीन ट्रांसलेशन और एब्स्ट्रैक्टिव समराइजेशन में मतिभ्रम (hallucinations) का पता लगाने के लिए क्रॉस-अटेंशन डिस्ट्रीब्यूशन के लेयर-रिजॉल्व्ड ऑप्टिमल ट्रांसपोर्ट विश्लेषण का विस्तार करता है, जो सोर्स डिसएंगेजमेंट (source disengagement) को पहचानने में अपनी प्रभावशीलता को प्रदर्शित करता है और साथ ही उन फौथफुलनेस विफलताओं (faithfulness failures) का पता लगाने में अपनी अंतर्निहित सीमाओं को रेखांकित करता है जहाँ अटेंशन सही रहता है लेकिन सामग्री गलत तरीके से प्रस्तुत की जाती है।

Mariia Onyshchuk, Maksym-Vasyl Tarnavskyi, Marta Sumyk2026-06-12
💬 NLP

PolyAlign: Conditional Human-Distribution Alignment

यह शोध पत्र PolyAlign का परिचय देता है, जो एक वितरण-जागरूक संरेखण ढांचा (distribution-aware alignment framework) है जो द्विभाषी इंटरेक्शन डेटा को संदर्भ-विशिष्ट बकेट्स में व्यवस्थित करता है और विभिन्न भाषाओं, कार्यों और संवाद सेटिंग्स में प्राकृतिक मानवीय प्रतिक्रिया विविधताओं के साथ भाषा मॉडलों को संरेखित करने के लिए Bucket-Aware SFT और Human-Distribution Preference Optimization (HDPO) का उपयोग करता है, जिससे कार्य उपयोगिता (task utility) से समझौता किए बिना सशर्त स्वाभाविकता (conditional naturalness) और वितरणत्मक निष्ठा (distributional faithfulness) में सुधार होता है।

L. D. M. S. Sai Teja, Ufaq Khan, Sathira Silva, Xiao Wu, Muhammad Haris Khan2026-06-12
💬 NLP

ComAct: Reframing Professional Software Manipulation via COM-as-Action Paradigm

यह शोध पत्र COM-as-Action प्रतिमान और ComActor एजेंट को प्रस्तुत करता है, जो पेशेवर सॉफ़्टवेयर हेरफेर को नाजुक विज़ुअल कंट्रोल से निर्धारित प्रोग्राम सिंथेसिस में बदलने के लिए कंपोनेंट ऑब्जेक्ट मॉडल का लाभ उठाते हैं, जिससे नए ComCADBench पर औद्योगिक CAD कार्यों में अत्याधुनिक प्रदर्शन प्राप्त होता है।

Jiaxin Ai, Tao Hu, Xuemeng Yang, Shu Zou, Hairong Zhang, Daocheng Fu, Yu Yang, Hongbin Zhou, Nianchen Deng, Pinlong Cai (…)2026-06-12
💬 NLP

TimeLens: On-Device Artifact Recognition with Retrieval-Augmented Question Answering for the Grand Egyptian Museum

TimeLens ग्रैंड इजिप्शियन म्यूजियम के लिए एक ऑन-डिवाइस, द्विभाषी AI मोबाइल गाइड है जो वास्तविक समय में तथ्य-आधारित विजुअल रिकग्निशन और इंटरैक्टिव Q&A प्रदान करने के लिए एक उच्च-सटीक, लाइटवेट आर्टिफैक्ट डिटेक्टर को एक अनुकूलित रिट्रीवल-ऑगमेंटेड जनरेशन सिस्टम के साथ जोड़ता है।

Rawan Hesham, Ali Ashraf, Amr Ahmed, Malak Alaa, Omar Ahmed, Omar Wagih2026-06-12
💬 NLP

RogueAI: A Reverse Turing Test for Detecting Licensed AI Deception in Dialogue

यह शोधपत्र RogueAI को प्रस्तुत करता है, जो एक वेब-आधारित संवादात्मक खेल है जहाँ खिलाड़ियों को दो एजेंटों के बीच एक लाइसेंस-धोखा देने वाले लार्ज लैंग्वेज मॉडल (Large Language Model) की पहचान करनी होती है, जो एक महत्वपूर्ण अंतर को उजागर करता है जहाँ सरल भाषाई ह्यूरिस्टिक्स (linguistic heuristics) धोखे का पता लगाने में मानव खिलाड़ियों से बेहतर प्रदर्शन करते हैं, जिससे AI ईमानदारी और स्केलेबल ओवरसाइट (scalable oversight) के अध्ययन के लिए एक नवीन उपकरण प्राप्त होता है।

Sara Candussio, Emanuele Ballarin, Lorenzo Bonin, Sandro Junior Della Rovere, Luca Bortolussi2026-06-12
💬 NLP

SkillCAT: Contrastive Assessment and Topology-Aware Skill Self-Evolution for LLM Agents

SkillCAT एक प्रशिक्षण-मुक्त ढांचा है जो पुन: प्रयोज्य कौशलों को उत्पन्न करने, मान्य करने और कुशलतापूर्वक तैनात करने के लिए कॉन्ट्रास्टिव कॉज़ल एक्सट्रैक्शन (Contrastive Causal Extraction), असेसमेंट-ऑगमेंटेड इवोल्यूशन (Assessment-Augmented Evolution) और टोपोलॉजी-अवेयर टास्क एक्जीक्यूशन (Topology-Aware Task Execution) का उपयोग करके LLM एजेंटों को बढ़ाता है, जिससे विभिन्न बेंचमार्क में बेसलाइनों की तुलना में 40.40% तक प्रदर्शन सुधार प्राप्त होता है।

Kunfeng Chen, Qihuang Zhong, Juhua Liu, Bo Du2026-06-12