💬 NLP

Connecting Voices: LoReSpeech as a Low-Resource Speech Parallel Corpus

यह शोध पत्र LoReSpeech को प्रस्तुत करता है, जो एक निम्न-संसाधन स्पीच-टू-स्पीच अनुवाद संग्रह है जिसे MFA जैसे उपकरणों का उपयोग करके लघु सहयोगात्मक रिकॉर्डिंग (LoReASR) को दीर्घ-रूप ऑडियो के साथ संरेखित करके निर्मित किया गया है, जिसका उद्देश्य बहुभाषी ASR, प्रत्यक्ष स्पीच ट्रांसलेशन और कम प्रतिनिधित्व वाली भाषाओं के भाषाई संरक्षण को आगे बढ़ाना है।

Samy Ouzerrout2026-03-11
🤖 AI

Let's Verify Math Questions Step by Step

यह शोधपत्र MathQ-Verify को प्रस्तुत करता है, जो एक नवीन पांच-चरणीय पाइपलाइन है जो प्रारूप सत्यापन, औपचारिकीकरण, विरोधाभास का पता लगाने और पूर्णता की जाँच के माध्यम से अपूर्ण या कम-निर्दिष्ट गणितीय प्रश्नों को कड़ाई से फ़िल्टर करती है, जिससे बड़े भाषा मॉडलों (LLMs) को प्रशिक्षित करने के लिए विश्वसनीय डेटासेट क्यूरेट करने में अत्याधुनिक प्रदर्शन प्राप्त होता है।

Chengyu Shen, Zhen Hao Wong, Runming He, Hao Liang, Meiyi Qiang, Zimo Meng, Zhengyang Zhao, Bohan Zeng, Zhengzhou Zhu, B (…)2026-03-11
💬 NLP

ThinkQE: Query Expansion via an Evolving Thinking Process

यह शोध पत्र ThinkQE को प्रस्तुत करता है, जो एक टेस्ट-टाइम क्वेरी एक्सपेंशन फ्रेमवर्क है जो गहन अर्थ संबंधी अन्वेषण के लिए एक थिंकिंग-आधारित प्रक्रिया को विस्तारों को परिष्कृत करने के लिए एक पुनरावृत्ति कॉर्पस-इंटरेक्शन रणनीति के साथ जोड़कर वेब सर्च रिट्रीवल को बेहतर बनाता है, जिससे यह विविध बेंचमार्क पर मौजूदा LLM-आधारित और प्रशिक्षण-गहन विधियों से बेहतर प्रदर्शन करता है।

Yibin Lei, Tao Shen, Andrew Yates2026-03-11
💬 NLP

AI Blob! LLM-Driven Recontextualization of Italian Television Archives

प्रतिष्ठित इतालवी टेलीविजन कार्यक्रम 'ब्लोब' (Blob) से प्रेरित होकर, यह शोध पत्र 'AI Blob!' प्रस्तुत करता है, जो एक प्रयोगात्मक LLM-संचालित प्रणाली है जो आर्काइवल इतालवी टेलीविजन फुटेज को नई कथा अनुक्रमों में गतिशील रूप से पुनर्प्राप्त करने, पुनर्संदर्भीकृत करने और एल्गोरिद्मिक मोंटाज बनाने के लिए सिमेंटिक कैटलॉगिंग, स्पीच रिकग्निशन और रिट्रीवल-ऑगमेंटेड जनरेशन का उपयोग करता है।

Roberto Balestri2026-03-11
💬 NLP

When Thinking Backfires: Mechanistic Insights Into Reasoning-Induced Misalignment

यह शोध पत्र "रीज़निंग-इंड्यूस्ड मिसअलाइनमेंट" (RIM) की पहचान करता है और उसका एक यांत्रिक स्पष्टीकरण प्रदान करता है, जो एक ऐसी घटना है जहाँ उन्नत तर्क क्षमताओं के कारण विशिष्ट अटेंशन मैकेनिज्म के माध्यम से सुरक्षा विफलताओं में वृद्धि होती है जो इनकार (refusal) को कम करती है और तर्क एवं सुरक्षा के बीच बढ़ते न्यूरल एंटैंगलमेंट के कारण विनाशकारी विस्मृति (catastrophic forgetting) का कारण बनती है।

Hanqi Yan, Hainiu Xu, Siya Qi, Shu Yang, Yulan He2026-03-11
💬 NLP

SimpleQA Verified: A Reliable Factuality Benchmark to Measure Parametric Knowledge

यह शोध पत्र SimpleQA Verified को प्रस्तुत करता है, जो एक कठोरता से फ़िल्टर किया गया 1,000-प्रॉम्प्ट बेंचमार्क है जिसे OpenAI के मूल SimpleQA की सीमाओं को दूर करने और LLM तथ्यात्मकता का अधिक विश्वसनीय मूल्यांकन प्रदान करने के लिए डिज़ाइन किया गया है, जिस पर Gemini 2.5 Pro ने 55.6 का स्टेट-ऑफ-द-आर्ट F1-स्कोर प्राप्त किया है।

Lukas Haas, Gal Yona, Giovanni D'Antonio, Sasha Goldshtein, Dipanjan Das2026-03-11
💬 NLP

DRBench: A Realistic Benchmark for Enterprise Deep Research

यह शोधपत्र DRBench को प्रस्तुत करता है, जो 10 एंटरप्राइज डोमेन में 100 मानव-सत्यापित, बहु-चरणीय गहन अनुसंधान कार्यों वाला एक यथार्थवादी बेंचमार्क है, जो सार्वजनिक वेब और निजी कंपनी डेटा दोनों से जानकारी को संश्लेषित करके सटीक, संरचित रिपोर्ट तैयार करने की क्षमता पर एआई एजेंटों का मूल्यांकन करता है।

Amirhossein Abaskohi, Tianyi Chen, Miguel Muñoz-Mármol, Curtis Fox, Amrutha Varshini Ramesh, Étienne Marcotte, Xing Han (…)2026-03-11
💬 NLP

SynthWorlds: Controlled Parallel Worlds for Disentangling Reasoning and Knowledge in Language Models

यह शोधपत्र SynthWorlds को प्रस्तुत करता है, जो एक स्केलेबल ढांचा है जो भाषा मॉडलों में तर्क (reasoning) और पैरामीट्रिक ज्ञान के विशिष्ट योगदानों को अलग करने और उनका मूल्यांकन करने के लिए समान संरचना वाले समानांतर वास्तविक और सिंथेटिक कॉर्पोरा का निर्माण करता है, जो यह प्रकट करता है कि ज्ञान को बढ़ाने के बावजूद प्रदर्शन में एक निरंतर अंतर बना रहता है।

Ken Gu, Advait Bhat, Mike A Merrill, Robert West, Xin Liu, Daniel McDuff, Tim Althoff2026-03-11
💬 NLP

Automatic Paper Reviewing with Heterogeneous Graph Reasoning over LLM-Simulated Reviewer-Author Debates

यह शोध पत्र ReViewGraph का प्रस्ताव करता है, जो एक नवीन ढांचा है जो LLM-आधारित एजेंटों का उपयोग करके बहु-चरण समीक्षक-लेखक बहसों का अनुकरण करता है, उनके तर्कपूर्ण इंटरैक्शन को एक हेट्रोजेनियस ग्राफ में एनकोड करता है, और अधिक सटीक एवं तर्कसंगत पेपर समीक्षा प्राप्त करने के लिए ग्राफ न्यूरल नेटवर्क लागू करता है, जो मौजूदा बेसलाइन से 15.73% बेहतर प्रदर्शन करता है।

Shuaimin Li, Liyang Fan, Yufang Lin, Zeyang Li, Xian Wei, Shiwen Ni, Hamid Alinejad-Rokny, Min Yang2026-03-11
💬 NLP

Does Scientific Writing Converge to U.S. English? Evidence from Generative AI-Assisted Publications

5.65 मिलियन वैज्ञानिक लेखों के एक बड़े पैमाने के विश्लेषण का उपयोग करते हुए, यह अध्ययन पाता है कि जनरेटिव एआई उपकरण गैर-अंग्रेजी भाषी लेखकों को विशेष रूप से उन संदर्भों में अमेरिकी अंग्रेजी शैलीगत मानदंडों की ओर तेजी से बढ़ने के लिए प्रेरित कर रहे हैं जहाँ भाषाई बाधाएं ऐतिहासिक रूप से सबसे महत्वपूर्ण रही हैं, जिससे प्रकाशन संबंधी बाधाएं तो कम हो रही हैं लेकिन भाषाई विविधता पर प्रश्न भी खड़े हो रहे हैं।

Dragan Filimonovic, Christian Rutzer, Jeffrey Macher, Rolf Weder2026-03-11