💬 NLP

Talk to Your Slides: High-Efficiency Slide Editing via Language-Driven Structured Data Manipulation

यह शोध पत्र "Talk to Your Slides" प्रस्तुत करता है, जो एक उच्च-दक्षता वाला स्लाइड संपादन एजेंट है जो मल्टीमॉडल LLM-आधारित GUI एजेंटों की तुलना में तेज़, अधिक सटीक और लागत प्रभावी टेक्स्ट-केंद्रित और फॉर्मेटिंग संशोधनों को प्राप्त करने के लिए विजुअल परसेप्शन के बजाय भाषा-संचालित संरचित डेटा हेरफेर का लाभ उठाता है, जिसे नए प्रस्तावित TSBench बेंचमार्क द्वारा समर्थित किया गया है।

Kyudan Jung, Hojun Cho, Jooyeol Yun, Soyoung Yang, Jaehyeok Jang, Jaegul Choo2026-03-04
💬 NLP

REFLEX: Metacognitive Reasoning for Reflective Zero-Shot Robotic Planning with Large Language Models

यह शोध पत्र REFLEX को प्रस्तुत करता है, जो एक मेटाकॉग्निटिव फ्रेमवर्क है जो LLM-संचालित रोबोटिक एजेंटों को कौशल को विभाजित करने, विफलताओं पर चिंतन करने और नवीन समाधानों को रचनात्मक रूप से संश्लेषित करने के लिए सशक्त बनाता है, जिससे जटिल मल्टी-रोबोट सहयोग कार्यों में उनके ज़ीरो-शॉट और फ्यू-शॉट प्रदर्शन को महत्वपूर्ण रूप से बढ़ाया जा सकता है।

Wenjie Lin, Jin Wei-Kocsis, Jiansong Zhang, Byung-Cheol Min, Dongming Gan, Paul Asunda, Ragu Athinarayanan2026-03-04
🤖 AI

DiaBlo: Diagonal Blocks Are Sufficient For Finetuning

DiaBlo एक पैरामीटर-कुशल फाइन-ट्यूनिंग विधि है जो मॉडल वेट मैट्रिसेस के केवल विकर्ण ब्लॉकों (diagonal blocks) को अपडेट करती है, जो LoRA का एक सरल, स्थिर और सैद्धांतिक रूप से सुदृढ़ विकल्प प्रदान करती है और प्रतिस्पर्धी प्रदर्शन के साथ तुलनीय मेमोरी दक्षता और प्रशिक्षण गति प्राप्त करती है।

Selcuk Gurses, Aozhong Zhang, Yanxia Deng, Xun Dong, Xin Li, Naigang Wang, Penghang Yin, Zi Yang2026-03-04
💬 NLP

Go-Browse: Training Web Agents with Structured Exploration

यह शोध पत्र Go-Browse को प्रस्तुत करता है, जो एक ऐसी विधि है जो वेब एजेंट प्रक्षेपवक्र (trajectories) का एक बड़े पैमाने पर डेटासेट स्वचालित रूप से एकत्र करने के लिए संरचित ग्राफ-आधारित अन्वेषण का उपयोग करती है, जिसे जब एक 7B भाषा मॉडल को फाइन-ट्यून करने के लिए उपयोग किया जाता है, तो यह WebArena बेंचमार्क पर अत्याधुनिक (state-of-the-art) प्रदर्शन प्राप्त करता है।

Apurva Gandhi, Graham Neubig2026-03-04
🤖 AI

LLM Probability Concentration: How Alignment Shrinks the Generative Horizon

यह शोध पत्र ब्रांचिंग फैक्टर (BF) को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि अलाइनमेंट ट्यूनिंग जनरेशन के शुरुआती चरणों में संभाव्यता वितरण (probability distributions) को केंद्रित करके LLM की आउटपुट विविधता को महत्वपूर्ण रूप से कम कर देती है, जो कि एक ऐसी प्रक्रिया है जो चेन-ऑफ-थॉट मॉडल्स में रीजनिंग स्थिरता को बढ़ाती है और जिसे रणनीतिक टोकन प्रॉम्प्टिंग के माध्यम से बेस मॉडल्स में भी दोहराया जा सकता है।

Chenghao Yang, Sida Li, Ari Holtzman2026-03-04
💬 NLP

Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy

यह शोध पत्र Skywork-Reward-V2 को प्रस्तुत करता है, जो 40-मिलियन-जोड़ी वाले SynPref-40M डेटासेट पर प्रशिक्षित अत्याधुनिक रिवॉर्ड मॉडल्स का एक समूह है, जिसे मौजूदा प्रेफरेंस डेटा की सीमाओं को दूर करने और कई बेंचमार्क में बेहतर प्रदर्शन प्राप्त करने के लिए एक मानव-AI सहयोगात्मक पाइपलाइन का उपयोग करके बनाया गया था।

Chris Yuhao Liu, Liang Zeng, Yuzhen Xiao, Jujie He, Jiacai Liu, Chaojie Wang, Rui Yan, Wei Shen, Fuxiang Zhang, Jiacheng (…)2026-03-04
💬 NLP

Link Prediction for Event Logs in the Process Industry

यह शोध पत्र एक नवीन रिकॉर्ड लिंकिंग मॉडल प्रस्तावित करता है जो जर्मन प्रक्रिया उद्योग में खंडित इवेंट लॉग्स के बीच लिंक्स की प्रभावी ढंग से भविष्यवाणी करने के लिए नेचुरल लैंग्वेज इंफरेंस और सिमेंटिक टेक्स्ट सिमिलैरिटी को जोड़कर क्रॉस-डॉक्यूमेंट कोरफरेन्स रेजोल्यूशन को अनुकूलित करता है, जिससे ग्राफ-आधारित रिट्रीवल-ऑगमेंटेड जनरेशन अनुप्रयोगों के लिए डेटा गुणवत्ता में महत्वपूर्ण सुधार होता है।

Anastasia Zhukova, Thomas Walton, Christian E. Lobmüller, Bela Gipp2026-03-04
💬 NLP

No Text Needed: Forecasting MT Quality and Inequity from Fertility and Metadata

यह शोध पत्र यह प्रदर्शित करता है कि टोकन उर्वरता (fertility), गणना और बुनियादी भाषाई मेटाडेटा का लाभ उठाकर, अनुवाद प्रणाली को निष्पादित किए बिना ही 203 भाषाओं में GPT-4o के लिए अनुवाद गुणवत्ता का सटीक पूर्वानुमान लगाया जा सकता है, जो यह प्रकट करता है कि टोपोलॉजिकल कारक और उर्वरता बहुभाषी प्रदर्शन को महत्वपूर्ण रूप से आकार देते हैं।

Jessica M. Lundin, Ada Zhang, David Adelani, Cody Carroll2026-03-04
💬 NLP

The Token Tax: Systematic Bias in Multilingual Tokenization

यह शोध पत्र यह प्रदर्शित करता है कि टोकनाइज़ेशन की अक्षमता रूपात्मक रूप से जटिल, कम संसाधन वाली अफ्रीकी भाषाओं पर एक "टोकन टैक्स" आरोपित करती है, जो उच्च टोकन फर्टिलिटी को कम सटीकता और काफी बढ़ी हुई लागत के साथ सहसंबंधित करती है, जबकि यह भी रेखांकित करता है कि रीजनिंग मॉडल इन प्रदर्शन अंतराल को कम करने में मदद कर सकते हैं।

Jessica M. Lundin, Ada Zhang, Nihal Karim, Hamza Louzan, Victor Wei, David Adelani, Cody Carroll2026-03-04
💬 NLP

Bridging Kolmogorov Complexity and Deep Learning: Asymptotically Optimal Description Length Objectives for Transformers

यह शोध पत्र ट्रांसफॉर्मर्स के लिए स्पर्शोन्मुखी (asymptotically) इष्टतम विवरण लंबाई उद्देश्यों के अस्तित्व को सिद्ध करके और एक सुलभ वेरिएशनल कार्यान्वयन का प्रदर्शन करके, जो महत्वपूर्ण अनुकूलन चुनौतियों के बावजूद कम-जटिलता वाले सामान्यीकरण को बढ़ावा देता है, कोलमोगोरोव जटिलता और डीप लर्निंग के बीच के अंतर को पाटता है।

Peter Shaw, James Cohan, Jacob Eisenstein, Kristina Toutanova2026-03-04