💬 NLP

Locally Coherent Parallel Decoding in Diffusion Language Models

यह शोध पत्र CoDiLA प्रस्तुत करता है, जो एक ऐसी विधि है जो स्थानीय टोकन सुसंगतता सुनिश्चित करने के लिए समानांतर ब्लॉक जनरेशन को एक संक्षिप्त सहायक ऑटो-रिग्रेसिव मॉडल के साथ जोड़कर डिफ्यूजन लैंग्वेज मॉडल्स को उन्नत करती है, जिससे मानक डिस्क्रीट डिफ्यूजन दृष्टिकोणों में सामान्य सिंटैक्टिक विसंगतियों को समाप्त करते हुए सब-लीनियर लेटेंसी प्राप्त की जा सकती है।

Michael Hersche, Nicolas Menet, Ronan Tanios, Abbas Rahimi2026-03-24
💬 NLP

Expected Reward Prediction, with Applications to Model Routing

यह शोध पत्र एक ऐसी विधि प्रस्तुत करता है जो किसी प्रतिक्रिया को उत्पन्न करने से पहले, एक दिए गए प्रॉम्प्ट पर एक LLM द्वारा प्राप्त किए जाने वाले अपेक्षित रिवॉर्ड (reward) की भविष्यवाणी करती है, यह प्रदर्शित करते हुए कि यह सरल भविष्यवाणी एक कुशल और विस्तार योग्य मॉडल रूटिंग प्रोटोकॉल को सक्षम बनाती है जो रिवॉर्ड और कम्प्यूटेशनल लागत के बीच संतुलन को अनुकूलित करके श्रेणी-आधारित बेसलाइन से बेहतर प्रदर्शन करती है।

Kenan Hasanaliyev, Silas Alberti, Jenny Hamer, Dheeraj Rajagopal, Kevin Robinson, Jasper Snoek, Victor Veitch, Alexander (…)2026-03-24
💬 NLP

Thinking into the Future: Latent Lookahead Training for Transformers

यह शोध पत्र "लेटेंट लुकअहेड" (latent lookahead) को प्रस्तुत करता है, जो एक प्रशिक्षण रणनीति है जो ऑटोरेग्रेसिव ट्रांसफॉर्मर्स को किसी टोकन को निर्धारित करने से पहले लेटेंट स्पेस में भविष्यवाणियों को पुनरावृत्ति से परिष्कृत करने में सक्षम बनाती है, जिससे दूरदर्शिता की आवश्यकता वाले जटिल नियोजन कार्यों पर प्रदर्शन में उल्लेखनीय सुधार होता है।

Lorenzo Noci, Gregor Bachmann, Seyed-Mohsen Moosavi-Dezfooli, Moin Nabi2026-03-24
💬 NLP

Beyond Test-Time Compute Strategies: Advocating Energy-per-Token in LLM Inference

यह शोध पत्र "प्रति-टोकन ऊर्जा" (energy-per-token) को एक प्रमुख दक्षता मीट्रिक के रूप में अपनाने की वकालत करता है और गतिशील, ऊर्जा-जागरूक रूटिंग रणनीतियों का प्रस्ताव करता है जो संवर्धित लघु भाषा मॉडलों (Small Language Models) और नियंत्रित तर्क गहराई (reasoning depth) का लाभ उठाकर सटीकता और कम्प्यूटेशनल लागत के बीच संतुलन बनाते हैं ताकि टिकाऊ एआई परिनियोजन प्राप्त किया जा सके।

Patrick Wilhelm, Thorsten Wittkopp, Odej Kao2026-03-24
💻 computer science

Email in the Era of LLMs

यह शोध पत्र एचआर सिम्युलेटर (HR Simulator) का परिचय देता है, जो एक संचार खेल है जो यह प्रदर्शित करता है कि जबकि बड़े भाषा मॉडल (LLMs) अक्सर औपचारिक ईमेल परिदृश्यों में मनुष्यों से बेहतर प्रदर्शन करते हैं और अधिक सजातीय एवं शिष्ट प्राथमिकताएं प्रदर्शित करते हैं, मानव-LLM सहयोग सफलता दर को महत्वपूर्ण रूप से बढ़ाता है, जो संरचित संचार में LLMs की प्रभावकारिता और मानवीय-समान कम-सहानुभूतिपूर्ण, अनौपचारिक शैलियों की नकल करने में वर्तमान सीमाओं, दोनों को प्रकट करता है।

Dang Nguyen, Harvey Yiyun Fu, Peter West, Chenhao Tan, Ari Holtzman2026-03-24
💬 NLP

Decoding the decoder: Contextual sequence-to-sequence modeling for intracortical speech decoding

यह शोधपत्र एक मल्टीटास्क ट्रांसफॉर्मर-आधारित सीक्वेंस-टू-सीक्वेंस मॉडल पेश करता है जिसमें एक नवीन 'न्यूरल हैमर स्केल्पल' कैलिब्रेशन मॉड्यूल है जो ध्वनियों (फोनीम्स) और शब्दों की संयुक्त भविष्यवाणी करते हुए और दैनिक तंत्रिका परिवर्तनशीलता (न्यूरल वेरिएबिलिटी) को प्रभावी ढंग से संबोधित करते हुए, अत्याधुनिक इंट्राकोर्टिकल स्पीच डिकोडिंग प्रदर्शन प्राप्त करता है।

Michal Olak, Tommaso Boccato, Matteo Ferrante2026-03-24
💬 NLP

Abjad-Kids: An Arabic Speech Classification Dataset for Primary Education

यह शोध पत्र अबजद-किड्स (Abjad-Kids) को प्रस्तुत करता है, जो शैक्षिक वर्गीकरण कार्यों के लिए 3-12 वर्ष की आयु के बच्चों के लगभग 47,000 ऑडियो नमूनों वाला एक सार्वजनिक रूप से उपलब्ध अरबी भाषण डेटासेट है, और एक पदानुक्रमित सीएनएन-एलएसटीएम (CNN-LSTM) दृष्टिकोण प्रस्तावित करता है जो स्थिर भाषाई समूहीकरण के साथ सीमित नमूना आकारों के कारण ओवरफिटिंग की चुनौतियों के बावजूद बेहतर प्रदर्शन प्राप्त करता है।

Abdul Aziz Snoubara, Baraa Al_Maradni, Haya Al_Naal, Malek Al_Madrmani, Roaa Jdini, Seedra Zarzour, Khloud Al Jallad2026-03-24
💬 NLP

SciNav: A General Agent Framework for Scientific Coding Tasks

यह शोध पत्र SciNav को पेश करता है, जो वैज्ञानिक कोडिंग कार्यों के लिए एक सामान्य एजेंट फ्रेमवर्क है जो सीमित बजट के तहत उच्च-गुणवत्ता वाले समाधानों को कुशलतापूर्वक खोजने और चुनने के लिए एक ट्री सर्च प्रक्रिया के भीतर युग्मवार सापेक्ष निर्णयों (pairwise relative judgments) का लाभ उठाता है, जो विविध बेंचमार्क में मौजूदा प्रॉम्प्टिंग विधियों और पूर्ववर्ती एजेंटों से काफी बेहतर प्रदर्शन करता है।

Tianshu Zhang, Huan Sun2026-03-24
💻 computer science

OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis

OpenResearcher एक पूरी तरह से खुला, पुनरुत्पादक और ऑफलाइन पाइपलाइन पेश करता है जो 15M-दस्तावेजों के संग्रह से 97,000 से अधिक लॉन्ग-होरिज़न डीप रिसर्च ट्रेजेक्टरीज को संश्लेषित करता है, जिससे एक 30B-A3B मॉडल को BrowseComp-Plus पर 34-पॉइंट सटीकता सुधार प्राप्त करने में सक्षम बनाया जा सके और एजेंट डिज़ाइन रणनीतियों के विश्लेषण के लिए एक नियंत्रित वातावरण प्रदान किया जा सके।

Zhuofeng Li, Dongfu Jiang, Xueguang Ma, Haoxiang Zhang, Ping Nie, Yuyu Zhang, Kai Zou, Jianwen Xie, Yu Zhang, Wenhu Chen2026-03-24
💻 computer science

kRAIG: A Natural Language-Driven Agent for Automated DataOps Pipeline Generation

यह शोध पत्र kRAIG को प्रस्तुत करता है, जो एक ऐसा AI एजेंट है जो उपयोगकर्ता के इरादे को स्पष्ट करने के लिए ReQuesAct फ्रेमवर्क, डेटा ट्रांसफॉर्मेशन के लिए रिट्रीवल-ऑगमेंटेड टूल सिंथेसिस, और पाइपलाइन की विश्वसनीयता एवं सटीकता सुनिश्चित करने के लिए LLM-आधारित वैलिडेशन का उपयोग करके प्राकृतिक भाषा से प्रोडक्शन-रेडी Kubeflow Pipelines के निर्माण को स्वचालित करता है।

Rohan Siva, Kai Cheung, Lichi Li, Ganesh Sundaram2026-03-24