🤖 AI

VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion

यह शोध पत्र VoxENES 2026 को प्रस्तुत करता है, जो आधुनिक LLM-संचालित TTS और वॉयस कन्वर्जन सिस्टम से प्राप्त 53,628 ऑडियो नमूनों वाला एक द्विभाषी बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान स्पीच स्पूफिंग डिटेक्टर टेम्पोरल जनरलाइजेशन गैप और भंगुर आर्टिफैक्ट्स (brittle artifacts) पर निर्भरता के कारण प्रदर्शन में महत्वपूर्ण गिरावट का सामना करते हैं।

Aastha Sharma, Guangjing Wang2026-07-14
🤖 machine learning

Active Offline-to-Online Reinforcement Learning

यह शोध पत्र ऑफलाइन-टू-ऑनलाइन सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) के लिए एक नवीन सक्रिय नीति चयन ढांचे को प्रस्तुत करता है जो स्थानीय रूप से रैखिक प्रदर्शन पूर्वानुमानों से प्राप्त ऊपरी-विश्वास सीमाओं (अपर-कॉन्फिडेंस बाउंड्स) का उपयोग करके उम्मीदवार नीतियों के मूल्यांकन और सबसे आशाजनक नीतियों के फाइन-ट्यूनिंग के बीच के संतुलन को गतिशील रूप से संतुलित करके सीमित इंटरेक्शन बजट को अनुकूलित करता है।

Alper Kamil Bozkurt, Shangtong Zhang, Yuichi Motai2026-07-14
🤖 machine learning

Time-Lag-Aware Deep Reinforcement Learning for Flexible Job-Shop Scheduling in PPVC Module Factories

यह शोध पत्र एक टाइम-लैग-अवेयर (time-lag-aware) डीप रिइन्फोर्समेंट लर्निंग फ्रेमवर्क प्रस्तावित करता है जो लंबे पोस्ट-ऑपरेशन विलंब को स्पष्ट रूप से मॉडल करके, बिना किसी बाहरी सॉल्वर की आवश्यकता के, प्रीफैब्रिकेटेड मॉड्यूल कारखानों के लिए फ्लेक्सिबल जॉब-शॉप शेड्यूलिंग को अनुकूलित करने में पारंपरिक डिस्पैचिंग नियमों और मेटा-ह्यूरिस्टिक्स से काफी बेहतर प्रदर्शन करता है और लगभग इष्टतम मेक्सपैन (makespan) परिणाम प्राप्त करता है।

Ziheng Zhang, Wei Zhang2026-07-14
💬 NLP

Introducing Human-Centeredness in AI-Assisted Lexicography

यह शोध पत्र शब्दकोश विज्ञान (लेक्सिकोग्राफी) के लिए एक मानव-केंद्रित एआई ढांचा प्रस्तावित करता है जो चार प्रमुख आयामों—संवर्धित शब्दकोशकार (ऑगमेंटेड लेक्सिकोग्राफर्स), सामाजिक-तकनीकी संदर्भ, पूर्वाग्रह और उपकरण डिजाइन—की पहचान करता है ताकि यह सुनिश्चित किया जा सके कि एआई शब्दकोशकारों को प्रतिस्थापित करने के बजाय उन्हें संवर्धित करे और पेशेवर एजेंसी एवं भाषाई विविधता को संरक्षित रखे।

Antonio San Martin, Catherine Trekker2026-07-14
🤖 AI

MM-ToolSandBox: A Unified Framework for Evaluating Visual Tool-Calling Agents

यह शोधपत्र MM-ToolSandBox प्रस्तुत करता है, जो एक एकीकृत ढांचा और बेंचमार्क है जिसमें विजुअल टूल-कॉलिंग एजेंटों का मूल्यांकन करने के लिए 500+ टूल्स और 258 मानव-सत्यापित परिदृश्यों वाला एक स्टेटफुल वातावरण शामिल है, जो यह प्रकट करता है कि वर्तमान मॉडल विजुअल सटीकता के साथ काफी संघर्ष करते हैं और विफलता के मोड छोटे मॉडलों में योजना संबंधी कमियों से बड़े मॉडलों में धारणा संबंधी त्रुटियों की ओर स्थानांतरित हो जाते हैं।

Kaixin Ma, Di Feng, Alexander Metz, Jiarui Lu, Eshan Verma, Afshin Dehghan2026-07-14
🤖 machine learning

Transformer-Guided Swarm Intelligence for Frugal Neural Architecture Search

यह शोध पत्र एक मितव्ययी, हाइब्रिड न्यूरल आर्किटेक्चर सर्च फ्रेमवर्क प्रस्तावित करता है जो इमेज क्लासिफिकेशन और इम्बैलेंस्ड टैबुलर डेटा कार्यों के लिए कंज्यूमर-ग्रेड हार्डवेयर पर कॉम्पैक्ट, उच्च-प्रदर्शन वाले डीप लर्निंग मॉडल्स को कुशलतापूर्वक खोजने के लिए आर्टिफिशियल बी कॉलोनी एल्गोरिदम के साथ एक ट्रांसफॉर्मर-आधारित रीइन्फोर्समेंट लर्निंग कंट्रोलर को जोड़ता है।

Romain Amigon2026-07-14
🤖 AI

LoRA-Based Cascaded Multimodal Fusion for Action Recognition in Medical Training Environments

यह शोध पत्र एक पैरामीटर-कुशल, कैस्केडेड लो-रैंक एडेप्टेशन (LoRA) फ्रेमवर्क प्रस्तावित करता है जो चिकित्सा प्रशिक्षण वातावरण में क्रिया पहचान (action recognition) के लिए विषम मोडालिटीज़ को क्रमिक रूप से एकीकृत करता है, जो NurViD और नर्स ट्रेनिंग जैसे स्वास्थ्य देखभाल डेटासेट पर व्यक्तिगत मोडालिटी मॉडलों की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है।

Divya Mereddy, Jeevan Beedareddy2026-07-14
🤖 machine learning

A Minimalist Retargeting-Guided Reinforcement Learning Recipe for Dexterous Manipulation

यह शोधपत्र REGRIND को प्रस्तुत करता है, जो एक न्यूनतम पाइपलाइन है जो रिटारगेटिंग-गाइडेड सुदृढीकरण लर्निंग (reinforcement learning) को ज़ीरो-शॉट सिम-टू-रियल ट्रांसफर के साथ जोड़ता है ताकि केवल एक एकल मानव प्रदर्शन का उपयोग करके मल्टी-फिंगर्ड रोबोट्स पर डेक्सट्रस, कॉन्टैक्ट-रिच मैनिपुलेशन कार्यों को सक्षम किया जा सके।

Yunhai Feng, Natalie Leung, Jiaxuan Wang, Lujie Yang, Haozhi Qi, Preston Culbertson2026-07-14
🤖 machine learning

Invariant Learning Dynamics of Transformers in Inductive Reasoning Tasks

यह शोध पत्र एक सैद्धांतिक ढांचा प्रस्तुत करता है जो यह प्रदर्शित करता है कि सामान्यीकृत आगमनात्मक तर्क (inductive reasoning) कार्यों पर ट्रांसफॉर्मर की शिक्षण गतिशीलता (learning dynamics) एक निम्न-आयामी अपरिवर्तनीय मैनिफोल्ड (low-dimensional invariant manifold) तक सीमित है, जो इन-कॉन्टेक्स्ट बनाम इन-वेट्स लर्निंग के लक्षण वर्णन, प्रारंभिक स्थिति (initialization) के आधार पर सर्किट चयन की भविष्यवाणी, और सीखे गए सर्किट्स के स्वचालित पता लगाने को सक्षम बनाती है।

Tiberiu Musat, Tiago Pimentel, Nicholas Zucchet, Thomas Hofmann2026-07-14
🤖 AI

NeuroStrata: Harnessing Neurosymbolic Paradigms for Improved Design, Testability, and Verifiability of Autonomous CPS

यह शोध पत्र NeuroStrata को प्रस्तुत करता है, जो एक न्यूरोसिम्बोलिक फ्रेमवर्क है जिसे सुरक्षा प्रमाणन चुनौतियों को संबोधित करने के लिए स्टोकेस्टिक AI परतों को व्याख्या योग्य प्रतीकात्मक घटकों से बदलकर स्वायत्त साइबर-भौतिक प्रणालियों के डिज़ाइन, परीक्षण क्षमता और सत्यापन क्षमता को बढ़ाने के लिए डिज़ाइन किया गया है।

Xi Zheng, Ziyang Li, Ivan Ruchkin, Ruzica Piskac, Miroslav Pajic2026-07-13