🤖 AI

From Imitation to Alignment: Human-Preference Flow Policies for Long-Horizon Sidewalk Navigation

यह शोध पत्र FlowPilot को प्रस्तुत करता है, जो एक मैपलेस नेविगेशन पॉलिसी है जो लंबी अवधि के फुटपाथ कार्यों के लिए बड़े पैमाने पर फ्लीट डेटा पर एंकोर्ड फ्लो मैचिंग का उपयोग करके प्री-ट्रेनिंग करती है और सामाजिक अनुपालन एवं काउंटरफैक्चुअल रीजनिंग को बढ़ाने के लिए ह्यूम-इन-द-लूप प्रेफरेंस लर्निंग का लाभ उठाती है, जिससे केवल एक मोनोक्यूलर RGB कैमरे के साथ मजबूत प्रदर्शन प्राप्त होता है।

Honglin He, Zhizheng Liu, Yukai Ma, Bolei Zhou2026-06-12
🤖 AI

PersonaDrive: Human-Style Retrieval-Augmented VLA Agents for Closed-Loop Driving Simulation

PersonaDrive एक रिट्रीवल-ऑगमेंटेड VLA एजेंट फ्रेमवर्क है जो स्टाइल-इंस्ट्रक्टेड डेटासेट्स से रिट्रीव किए गए मानव प्रदर्शनों पर ड्राइविंग व्यवहार को कंडिशन करता है, जिससे क्लोज्ड-लूप सिमुलेशन एजेंटों को बिना किसी प्रति-स्टाइल रिट्रेनिंग के विविध मानव-समान ड्राइविंग शैलियों (आक्रामक, तटस्थ, रूढ़िवादी) को गतिशील रूप से अपनाने में सक्षम बनाया जाता है और साथ ही अत्याधुनिक प्रदर्शन प्राप्त किया जाता है।

Mahmoud Srewa, Praneetsai Iddamsetty, Mohammad Abdullah Al Faruque, Salma Elmalaki2026-06-12
🤖 AI

"Did you lie?" Evaluating Lie Detectors across Model Scale and Belief-Verified Model Organisms

यह शोध पत्र विभिन्न मॉडल पैमानों पर विविध झूठ पकड़ने वाले उपकरणों (lie detectors) का मूल्यांकन करता है और यह प्रकट करता है कि जहाँ वे प्रॉम्प्टेड झूठ (prompted lying) के मामले में क्षमता के साथ बढ़ते हैं, वहीं अधिकांश उपकरण सत्यापित छिपे हुए विश्वासों (verified hidden beliefs) वाले मॉडलों में झूठ पकड़ने में विफल रहते हैं, जो मॉडल की सत्यनिष्ठा को विश्वसनीय रूप से ऑडिट करने में इन उपकरणों की वर्तमान अक्षमता को रेखांकित करता है।

Alan Cooney, David Africa, Geoffrey Irving2026-06-12
🤖 AI

BASENet: Band-Adapted Speech Enhancement Network with Cross-Band Attention

BASENet एक अत्यधिक कुशल, आवृत्ति-अनुकूलित स्पीच एन्हांसमेंट नेटवर्क है जो न्यूनतम मापदंडों के साथ अत्याधुनिक प्रदर्शन प्राप्त करने के लिए बार्क-स्केल बैंड पार्टिशनिंग और क्रॉस-बैंड अटेंशन का लाभ उठाता है, जो इसे संसाधन-सीमित उपकरणों पर रीयल-टाइम परिनियोजन के लिए आदर्श बनाता है।

Damien Martins Gomes, François Capman2026-06-12
⚡ electrical engineering

Free-Placement Optimization of Ground Station Locations for Low-Earth Orbit Satellites

यह शोधपत्र SCORE को प्रस्तुत करता है, जो एक दो-चरणीय मुक्त-प्लेसमेंट अनुकूलन विधि है जो पारंपरिक निश्चित-स्थल और वन-शॉट दृष्टिकोणों की तुलना में लो-अर्थ ऑर्बिट उपग्रहों के लिए ग्राउंड स्टेशन नेटवर्क थ्रूपुट और अभिसरण दक्षता में महत्वपूर्ण सुधार करती है, जबकि नए बुनियादी ढांचे को तैनात करने और मौजूदा साइटों का उपयोग करने के बीच व्यावहारिक समझौते भी प्रदान करती है।

Grace Ra Kim, Duncan Eddy, Vedant Srinivas, Mykel J. Kochenderfer2026-06-12
🤖 AI

A Zero-shot Generalized Graph Anomaly Detection Framework via Node Reconstruction

यह शोध पत्र AlignGAD का प्रस्ताव करता है, जो एक ज़ीरो-शॉट जनरलाइज्ड ग्राफ एनोमली डिटेक्शन फ्रेमवर्क है जो वैश्विक संरेखण (ग्लोबल अलाइनमेंट), क्लस्टर-अवेयर व्यू कंस्ट्रक्शन और विसंगति स्कोरिंग के माध्यम से विषम विशेषताओं और संरचनाओं को एकीकृत करता है ताकि डेटासेट-विशिष्ट अर्थों पर निर्भर किए बिना अनदेखे लक्ष्य ग्राफों में असामान्य नोड्स की प्रभावी ढंग से पहचान की जा सके।

Phan Nguyen, Dat Cao, Hien Chu, Khue Hoang2026-06-12
🤖 AI

Evoflux: Inference-Time Evolution of Executable Tool Workflows for Compact Agents

यह शोध पत्र Evoflux को प्रस्तुत करता है, जो एक इन्फरेंस-टाइम इवोल्यूशनरी सर्च विधि है जो संरचित संपादन और निष्पादन फीडबैक के माध्यम से टाइप किए गए वर्कफ्लो ग्राफों की गतिशील रूप से मरम्मत और अनुकूलन करके कॉम्पैक्ट लैंग्वेज मॉडल्स के लिए टूल वर्कफ्लो की निष्पादन व्यवहार्यता में महत्वपूर्ण सुधार करता है, और लाइव टूल वातावरण में पारंपरिक सुपरवाइज्ड फाइन-ट्यूनिंग और रीइन्फोर्समेंट लर्निंग दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Kushal Raj Bhandari, Ling Yue, Ching-Yun Ko, Dhaval Patel, Shaowu Pan, Pin-Yu Chen, Jianxi Gao2026-06-12
🤖 AI

From AGI to ASI

यह रिपोर्ट मानव-स्तर की कृत्रिम सामान्य बुद्धिमत्ता (AGI) से कृत्रिम महाबुद्धिमत्ता (ASI) के सैद्धांतिक संक्रमण की जांच करती है, जिसमें चार संभावित विकास पथों को रेखांकित किया गया है, संबद्ध बाधाओं का विश्लेषण किया गया है, और यह तर्क दिया गया है कि भविष्य में एक एकल अचानक बदलाव के बजाय परिवर्तनकारी सामाजिक परिवर्तनों की एक श्रृंखला शामिल हो सकती है, जिससे तैयारी के लिए एक विशाल अंतरविषयक वैश्विक प्रयास आवश्यक हो जाता है।

Tim Genewein, Matija Franklin, Alexander Lerchner, Laurent Orseau, Samuel Albanie, Adam Bales, Cole Wyeth, Stephanie Cha (…)2026-06-12
🤖 AI

M*: A Modular, Extensible, Serving System for Multimodal Models

यह शोध पत्र M* को प्रस्तुत करता है, जो एक मॉड्यूलर और विस्तार योग्य सर्विंग सिस्टम है जो कंपोजिट मल्टीमॉडल मॉडल्स को डेटाफ्लो ग्राफ के रूप में निरूपित करता है ताकि लचीले घटक संयोजन और वितरित अनुकूलन को सक्षम किया जा सके, जिससे टेक्स्ट-टू-इमेज, टेक्स्ट-टू-स्पीच और रोबोटिक प्लानिंग जैसे विविध कार्यों में मौजूदा फ्रेमवर्क की तुलना में महत्वपूर्ण विलंबता (लेटेंसी) और थ्रूपुट सुधार प्राप्त होता है।

Atindra Jha, Naomi Sagan, Keisuke Kamahori, Irmak Sivgin, Rohan Sanda, Steven Gao, Mark Horowitz, Luke Zettlemoyer, Oliv (…)2026-06-12
🤖 AI

EWAM: An Enhanced World Action Model for Closed-Loop Online Adaptation in Embodied Intelligence

यह शोध पत्र EWAM को प्रस्तुत करता है, जो एक क्लोज्ड-लूप ऑनलाइन एडेप्टेशन फ्रेमवर्क है जो अनुभव स्मृति (experience memory), विसंगति का पता लगाने (anomaly detection), नीति रूटिंग (policy routing) और क्रिया सुधार (action correction) के लिए चार विभेदक न्यूरल परतों (differentiable neural layers) को एकीकृत करके ज़ीरो-शॉट एम्बोडीड इंटेलिजेंस के लिए एक फ्रोजन Cosmos3 बैकबोन को उन्नत करता है, जिससे अतिरिक्त प्रदर्शनों या फाइन-ट्यूनिंग के बिना नए टास्क लेआउट के प्रति मजबूत अनुकूलन सक्षम होता है।

Xin Zhou, Cong Miao2026-06-12