⚡ electrical engineering

Scaling Conversational Hungarian ASR: The BEA-Dialogue+ Corpus

यह शोध पत्र BEA-Dialogue+ को प्रस्तुत करता है, जो एक विस्तारित 200-घंटे का हंगेरियन संवादात्मक भाषण संग्रह (corpus) है जो स्पीकर ओवरलैप पर नियंत्रित अध्ययन सक्षम करने के लिए स्प्लिट मानदंडों को शिथिल करता है, और यह प्रदर्शित करता है कि सीरियलाइज्ड आउटपुट ट्रेनिंग (SOT) फाइन-ट्यूनिंग विभिन्न मॉडलों में संवाद ट्रांसक्रिप्शन प्रदर्शन में महत्वपूर्ण सुधार करती है।

Máté Gedeon, Piroska Zsófia Barta, Péter Mihajlik, Katalin Mády2026-06-01
🤖 machine learning

On Efficient Scaling of GNNs via IO-Aware Layers Implementations

यह शोध पत्र तीन प्रमुख लेयर परिवारों—SpMM, रिडक्शन (reduction), और अटेंशन (attention)—के लिए I/O-जागरूक GPU कर्नल कार्यान्वयन प्रस्तावित करके ग्राफ न्यूरल नेटवर्क में मेमोरी एक्सेस बाधाओं को संबोधित करता है, जो मौजूदा फ्रेमवर्क की तुलना में विविध ग्राफ संरचनाओं में महत्वपूर्ण गति वृद्धि और मेमोरी कमी प्राप्त करते हैं।

Daria Fomina, Daniil Krasylnikov, Alexey Boykov, Andrey Dolgovyazov, Vyacheslav Zhdanovskiy, Fedor Velikonivtsev2026-06-01
🤖 AI

Feature-Optimized Vision for Adaptive 3D Scene Reconstruction

यह शोध पत्र एक अनुकूलनशील फीचर-अनुकूलित विजन फ्रंट एंड का प्रस्ताव करता है जो 3D दृश्य पुनर्निर्माण में कम्प्यूटेशनल बर्बादी को कम करते हुए पुनर्निर्माण की गुणवत्ता और पूर्णता को अधिकतम करने के लिए बनावट (टेक्सचर), पुनरावृत्ति (रिपीटेबिलिटी), विशिष्टता और ज्यामितीय उपयोगिता के आधार पर प्रति-दृश्य फीचर बजट को गतिशील रूप से आवंटित करता है।

Eric Liang2026-06-01
💬 NLP

Vision-Language Models Suppress Female Representations Under Ambiguous Input

यह शोध पत्र यह प्रकट करता है कि जहाँ विजन-लैंग्वेज मॉडल अक्सर अस्पष्ट छवियों के लिए आंतरिक रूप से महिला संघों को एनकोड करते हैं, वहीं उनके आउटपुट व्यवस्थित रूप से पुरुष निरूपणों की ओर डिफ़ॉल्ट होते हैं क्योंकि एक विषम फ़िल्टरिंग तंत्र जनरेशन के दौरान पुरुष संकेतों को बढ़ाता है और महिला संकेतों को दबा देता है।

Arnau Marin-Llobet, Simon Henniger, Mahzarin R. Banaji2026-06-01
🤖 machine learning

Positional versus Symbolic Attention Heads: Learning Dynamics, RoPE Geometry, and Length Generalization

यह शोधपत्र संरचनात्मक रूप से समान तर्क संबंधी कार्यों (reasoning tasks) पर ट्रांसफॉर्मर अटेंशन हेड्स की लर्निंग डायनेमिक्स की जांच करता है, जो यह प्रकट करता है कि सफल लर्निंग में विशिष्ट पोजीशनल और सिम्बोलिक तंत्रों का उद्भव शामिल है, जहाँ बाद वाला तंत्र पूर्व की तुलना में लंबी अनुक्रमों (sequences) के प्रति बेहतर मजबूती और सामान्यीकरण प्रदर्शित करता है।

Felipe Urrutia, Juan José Alegría, Cinthia Sanchez Macias, Jorge Salas, Cristian B. Calderon, Cristobal Rojas2026-06-01
🤖 AI

SPECTRA: Synthetic IR Test Collections with Relevance Oracles and Controlled Distractor Diagnostics

यह शोध पत्र SPECTRA को प्रस्तुत करता है, जो एक पुनरुत्पादक (reproducible) पायथन फ्रेमवर्क है जो सूचना पुनर्प्राप्ति (information retrieval) प्रणाली के प्रदर्शन और विफलता के रूपों का निदान करने के लिए नियत प्रासंगिकता ओरेकल (deterministic relevance oracles) के साथ स्केलेबल सिंथेटिक टेक्स्ट कॉर्पोरा और रिट्रीवल टेस्ट कलेक्शंस उत्पन्न करता है, जिससे महंगे मानव-एनोटेटेड कलेक्शंस बनाए जाने से पहले ही इनका परीक्षण किया जा सके।

Eric Liang2026-06-01
🤖 AI

Choosing the Lens: Strategic Perspective Activation in Context-Dependent Argumentation

यह शोधपत्र कॉन्टेक्स्ट-डिपेंडेंट आर्गुमेंटेशन फ्रेमवर्क्स (CDAFs) को पेश करता है ताकि यह मॉडल किया जा सके कि एजेंट विशिष्ट दृष्टिकोणों को सक्रिय करके तर्क की स्वीकृति में रणनीतिक रूप से हेरफेर कैसे कर सकते हैं जो यह निर्धारित करते हैं कि कौन से हमले सफल होते हैं, एक ऐसी क्षमता जिसे मानक औपचारिकताएं नहीं पकड़ पाती हैं, और इससे जुड़े ACTIVATION-MANIPULATION निर्णय समस्या को परिभाषित करता है।

Albert Sadowski, Jarosław A. Chudziak2026-06-01
💬 NLP

Language Models Learn Constructional Semantics, Not To Mention Syntax: Investigating LM Understanding of Paired-Focus Constructions

यह शोध पत्र प्रदर्शित करता है कि मध्यम आकार के ओपन-सोर्स भाषा मॉडल दुर्लभ युग्मित-केंद्रित (paired-focus) संरचनाओं के अर्थों को प्रभावी ढंग से समझ सकते हैं, जिसमें यह समझ सिंटैक्टिक ज्ञान की तुलना में प्रशिक्षण के बाद उभरती है और विश्व ज्ञान के विशिष्ट क्षेत्रों में होने वाली वृद्धि के साथ सह-संबंधित है।

Wesley Scivetti, Ethan Wilcox, Nathan Schneider, Kanishka Misra, Leonie Weissweiler2026-06-01
🤖 AI

Stateful Online Monitoring Catches Distributed Agent Attacks

यह शोध पत्र एक स्टेटफुल ऑनलाइन मॉनिटरिंग सिस्टम पेश करता है जो कई उपयोगकर्ता खातों में कमजोर संदिग्ध संकेतों को वास्तविक समय में एकत्रित करके वितरित एजेंट हमलों (डिस्ट्रीब्यूटेड एजेंट अटैक्स) का पता लगाता है, जो नगण्य विलंबता (लेटेंसी) बनाए रखते हुए पारंपरिक सिंगल-कॉन्टेक्स्ट मॉनिटर्स की सीमाओं को प्रभावी ढंग से दूर करता है।

Davis Brown, Samarth Bhargav, Arav Santhanam, Kasper Hong, Ivan Zhang, Matan Shtepel, Steffi Chern, Alexander Robey, Eri (…)2026-06-01
🤖 AI

A Survey on Recent Advances in Conversational Data Generation

यह शोध पत्र सिंथेटिक संवादात्मक डेटा जनरेशन में हालिया प्रगति का एक व्यापक सर्वेक्षण प्रस्तुत करता है, जो ओपन-डोमेन, कार्य-उन्मुख और सूचना-खोज प्रणालियों में मल्टी-टर्न संवादों को बनाने की विधियों की व्यवस्थित रूप से समीक्षा करता है, साथ ही एक सामान्य ढांचे, मूल्यांकन मेट्रिक्स, वर्तमान चुनौतियों और भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Heydar Soudani, Roxana Petcu, Evangelos Kanoulas, Faegheh Hasibi2026-05-29