💻 computer science

The Hive Mind is a Single Reinforcement Learning Agent

यह शोध पत्र यह स्थापित करता है कि विशुद्ध रूप से अनुकरण करने वाले एजेंटों के झुंड, जैसे कि मधुमक्खियाँ, का उभरता हुआ "हाइव माइंड" (सामूहिक मस्तिष्क), सामूहिक निर्णय लेने को अनुकूलित करने के लिए "मेइनार्ड-क्रॉस लर्निंग" नामक एक नवीन मल्टी-आर्म्ड बैंडिट एल्गोरिदम का उपयोग करने वाले एक एकल ऑनलाइन सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) एजेंट के गणितीय रूप से समकक्ष है।

Karthik Soma, Yann Bouteiller, Heiko Hamann, Giovanni Beltrame2026-05-06
🤖 AI

Low-Latency Video Anonymization for Crowd Anomaly Detection: Privacy Versus Performance

यह शोध पत्र LA3D का प्रस्ताव करता है, जो एक हल्का अनुकूलन योग्य गुमनामी (anonymization) तरीका है जो वास्तविक समय वीडियो विसंगति पहचान प्रदर्शन को बनाए रखते हुए भीड़ निगरानी के लिए पर्याप्त गोपनीयता सुरक्षा प्राप्त करता है, और पारंपरिक एवं डीप लर्निंग-आधारित दोनों दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Mulugeta Weldezgina Asres, Lei Jiao, Christian Walter Omlin2026-05-06
🤖 AI

The Pragmatic Frames of Spurious Correlations in Machine Learning: Interpreting How and Why They Matter

यह शोध पत्र तर्क देता है कि मशीन लर्निंग अनुसंधान में, स्पूरियस कोरिलेशन (spurious correlations) की अवधारणा निश्चित सांख्यिकीय गुणों द्वारा परिभाषित नहीं होती है, बल्कि इसके बजाय इसे चार "व्यावहारिक ढांचों" (प्रैग्मैटिक फ्रेम्स)—प्रासंगिकता, सामान्यीकरण क्षमता, मानव-समानता और हानिकारकता—के माध्यम से बातचीत/परक्रामण के जरिए तय किया जाता है, जो मॉडल व्यवहार के बारे में स्थित तकनीकी, ज्ञानमीमांसीय और नैतिक निर्णयों को दर्शाते हैं।

Samuel J. Bell, Skyler Wang2026-05-06
💬 NLP

Multiple Choice Questions: Reasoning Makes Large Language Models (LLMs) More Self-Confident, Especially When They are Wrong

यह शोध पत्र प्रदर्शित करता है कि चेन-ऑफ-थॉट प्रॉम्प्टिंग बड़े भाषा मॉडलों के आत्मविश्वास को व्यवस्थित रूप से बढ़ा देती है, विशेष रूप से तब जब वे गलत होते हैं, जिससे अंशांकन (कैलिब्रेशन) खराब होता है और संभाव्यता-आधारित मूल्यांकन अविश्वसनीय हो जाता है।

Tairan Fu, Javier Conde, Gonzalo Martínez, María Grandury, Pedro Reviriego2026-05-06
🤖 AI

Large Language Models for Multi-Robot Systems: A Survey

यह सर्वेक्षण मल्टी-रोबोट सिस्टम में लार्ज लैंग्वेज मॉडल्स को एकीकृत करने की पहली समर्पित समीक्षा प्रदान करता है, जो कार्य आवंटन (टास्क एलोकेशन), मोशन प्लानिंग और मानव संपर्क के माध्यम से उनके अनुप्रयोगों को व्यवस्थित रूप से वर्गीकृत करता है और वर्तमान चुनौतियों का विश्लेषण करते हुए भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Peihan Li, Zijian An, Shams Abrar, Lifeng Zhou2026-05-06
🤖 machine learning

Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks

यह शोध पत्र "बायस इनहेरिटेंस" (पूर्वाग्रह विरासत) की पहली व्यवस्थित जांच प्रस्तुत करता है, जो यह प्रदर्शित करता है कि डेटा संवर्धन (डेटा ऑग्मेंटेशन) के लिए उपयोग किए जाने वाले लार्ज लैंग्वेज मॉडल्स (LLMs) कैसे डाउनस्ट्रीम कार्यों में प्रशिक्षण पूर्वाग्रहों को प्रसारित और प्रवर्धित कर सकते हैं, साथ ही प्रमुख मिसअलाइनमेंट कारकों की पहचान करता है और इस चुनौती से निपटने के लिए तीन विशिष्ट शमन रणनीतियों का प्रस्ताव करता है।

Miaomiao Li, Hao Chen, Yang Wang, Tingyuan Zhu, Weijia Zhang, Kaijie Zhu, Kam-Fai Wong, Jindong Wang2026-05-06
💻 computer science

Safety Must Precede the Deployment of Open-Ended AI

यह स्थिति पत्र तर्क देता है कि ओपन-एंडेड एआई सिस्टम द्वारा उत्पन्न अनूठी सुरक्षा चुनौतियों, जैसे कि पूर्वानुमान क्षमता की कमी और उभरता हुआ मिसअलाइनमेंट (misalignment), को उनके बड़े पैमाने पर परिनियोजन से पहले समन्वित अनुसंधान और कार्रवाई के माध्यम से सक्रिय रूप से संबोधित किया जाना चाहिए।

Ivaxi Sheth, Jan Wehner, Sahar Abdelnabi, Ruta Binkyte, Mario Fritz2026-05-06
💻 computer science

Closed-Loop Vision-Language Planning for Multi-Agent Coordination

यह शोध पत्र COMPASS को प्रस्तुत करता है, जो एक नवीन मल्टी-एजेंट फ्रेमवर्क है जो कोड-आधारित कौशल परिशोधन और संरचित संचार के साथ विकेंद्रीकृत, क्लोज्ड-लूप प्लानिंग के लिए विजन-लैंग्वेज मॉडल्स का लाभ उठाता है, और पारंपरिक MARL बेसलाइन्स से काफी बेहतर प्रदर्शन करते हुए SMACv2 बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करता है।

Zhiyuan Li, Wenshuai Zhao, Joni Pajarinen2026-05-06
🤖 AI

MusicInfuser: Making Video Diffusion Listen and Dance

MusicInfuser एक कुशल विधि है जो विशिष्ट परतों को चुनिंदा रूप से फाइन-ट्यून करके पूर्व-प्रशिक्षित टेक्स्ट-टू-वीडियो डिफ्यूजन मॉडल को उच्च-गुणवत्ता वाले, संगीत-तुल्य नृत्य वीडियो उत्पन्न करने के लिए अनुकूलित करती है, जिससे बिना किसी मोशन डेटा या व्यापक कम्प्यूटेशनल संसाधनों की आवश्यकता के, मजबूत सामान्यीकरण और सिंक्रोनाइज़ेशन प्राप्त होता है।

Susung Hong, Ira Kemelmacher-Shlizerman, Brian Curless, Steven M. Seitz2026-05-06
💬 NLP

Hallucination Detection in LLMs with Topological Divergence on Attention Graphs

यह शोध पत्र TOHA को प्रस्तुत करता है, जो रिट्रीवल-ऑगमेंटेड जनरेशन (Retrieval-Augmented Generation) प्रणालियों के लिए एक टोपोलॉजी-आधारित मतिभ्रम डिटेक्टर (hallucination detector) है, जो प्रॉम्प्ट और रिस्पॉन्स अटेंशन ग्राफ्स के बीच टोपोलॉजिकल डाइवर्जेंस को मापकर तथ्यात्मक रूप से गलत आउटपुट की पहचान करता है, और न्यूनतम डेटा एवं कंप्यूटेशनल संसाधनों के साथ अत्याधुनिक प्रदर्शन प्राप्त करता है।

Alexandra Bazarova, Aleksandr Yugay, Andrey Shulga, Alina Ermilova, Andrei Volodichev, Konstantin Polev, Julia Belikova (…)2026-05-06