💬 NLP

Does language matter for spoken word classification? A multilingual generative meta-learning approach

यह शोध पत्र यह प्रदर्शित करता है कि बहुभाषी स्पोकन वर्ड क्लासिफिकेशन (बहुभाषी बोले गए शब्द वर्गीकरण) पर जेनेरेटिव मेटा-कॉन्टिनुअल लर्निंग लागू करने से यह पता चलता है कि प्रदर्शन का अधिक सटीक भविष्यवक्ता शामिल भाषाओं की संख्या के बजाय अद्वितीय प्रशिक्षण डेटा के कुल घंटे हैं, जिसमें बहुभाषी मॉडल अपने एकाकी (मोनोलिंगुअल) समकक्षों की तुलना में केवल मामूली रूप से बेहतर परिणाम दिखाते हैं।

Batsirayi Mupamhi Ziki, Louise Beyers, Ruan van der Merwe2026-05-14
💬 NLP

GeoBuildBench: A Benchmark for Interactive and Executable Geometry Construction from Natural Language

यह शोधपत्र GeoBuildBench प्रस्तुत करता है, जो 489 चीनी ज्यामिति समस्याओं वाला एक नया बेंचमार्क है जो प्राकृतिक भाषा से ज्यामितीय आरेख बनाने के लिए निष्पादन योग्य डोमेन-विशिष्ट भाषा प्रोग्राम उत्पन्न करने की मल्टीमॉडल एजेंटों की क्षमता का मूल्यांकन करता है, जो उचित प्रारंभिक प्रदर्शन के बावजूद संरचनात्मक सटीकता और बाधा संतुष्टि में महत्वपूर्ण चुनौतियों को प्रकट करता है।

Jinwoong Kim, Rui Yang, Huishuai Zhang2026-05-14
📊 statistics

LLMs as Implicit Imputers: Uncertainty Should Scale with Missing Information

यह शोध पत्र तर्क देता है कि एक अंतर्निहित इम्प्यूटर (imputer) के रूप में कार्य करने वाले लार्ज लैंग्वेज मॉडल्स को लुप्त सूचना के साथ अनिश्चितता का पैमाना प्रदर्शित करना चाहिए, यह पाते हुए कि जबकि सैंपलिंग-आधारित आत्मविश्वास संदर्भ क्षरण (context degradation) को दर्शाने में विफल रहता है, रिस्पॉन्स एंट्रॉपी (response entropy) लुप्तता को प्रभावी ढंग से ट्रैक करती है और सटीकता का बेहतर पूर्वानुमान लगाती है।

Stef van Buuren2026-05-14
💬 NLP

GAGPO: Generalized Advantage Grouped Policy Optimization

यह शोध पत्र जनरलाइज्ड एडवांटेज ग्रुपड पॉलिसी ऑप्टिमाइजेशन (GAGPO) का प्रस्ताव करता है, जो एक क्रिटिक-फ्री सुदृढीकरण लर्निंग (reinforcement learning) विधि है जो सैंपल्ड रोलआउट्स से नॉन-पैरामीट्रिक ग्रुपड वैल्यू प्रॉक्सीज़ का निर्माण करके मल्टी-टर्न लैंग्वेज मॉडल एजेंट्स में सटीक, स्टेप-अलाइन्ड टेम्पोरल क्रेडिट असाइनमेंट को सक्षम बनाती है, जिससे यह ALFWorld और WebShop जैसे वातावरणों में मौजूदा बेसलाइन्स से बेहतर प्रदर्शन करती है।

Siyuan Zhu, Chao Yu, Rongxin Yang, Zongkai Liu, Jinjun Hu, Qiwen Chen, Yibo Zhang2026-05-14
💬 NLP

Utility-Oriented Visual Evidence Selection for Multimodal Retrieval-Augmented Generation

यह शोध पत्र मल्टीमॉडल रिट्रीवल-ऑगमेंटेड जनरेशन के लिए एक ट्रेनिंग-फ्री, सूचना-सैद्धांतिक ढांचे का प्रस्ताव करता है जो दृश्य साक्ष्य को उसकी सिमेंटिक समानता के बजाय उसकी उपयोगिता (सूचना लाभ) के आधार पर चुनता है, जिससे कई बेंचमार्क में बेहतर रीजनिंग प्रदर्शन और कम्प्यूटेशनल दक्षता प्राप्त होती है।

Weiqing Luo, Zongye Hu, Xiao Wang, Zhiyuan Yu, Haofeng Zhang, Ziyi Huang2026-05-14
💬 NLP

CANTANTE: Optimizing Agentic Systems via Contrastive Credit Attribution

CANTANTE एक नवीन फ्रेमवर्क है जो सिस्टम-स्तरीय पुरस्कारों को व्यक्तिगत एजेंटों के प्रति विरोधाभासी एट्रिब्यूशन (contrastive attribution) के माध्यम से क्रेडिट-असाइनमेंट समस्या को हल करके LLM-आधारित मल्टी-एजेंट सिस्टम को अनुकूलित करता है, जिससे विविध बेंचमार्क में प्रॉम्प्ट ऑप्टिमाइज़ेशन में अत्याधुनिक प्रदर्शन प्राप्त होता है और इन्फरेंस लागत कम होती है।

Tom Zehle2026-05-14
💬 NLP

What Limits Vision-and-Language Navigation ?

यह शोध पत्र StereoNav को प्रस्तुत करता है, जो एक सुदृढ़ विज़न-लैंग्वेज-एक्शन फ्रेमवर्क है जो विज़न-एंड-लैंग्वेज नेविगेशन में सिमुलेशन-टू-रियल-वर्ल्ड अंतराल को दूर करने के लिए स्टीरियो विज़न और टार्गेट-लोकेशन प्रायर्स (Target-Location Priors) का लाभ उठाता है, जिससे स्केलिंग-आधारित दृष्टिकोणों की तुलना में कम पैरामीटर्स और कम प्रशिक्षण डेटा का उपयोग करते हुए जटिल वातावरण में बेहतर विश्वसनीयता के साथ अत्याधुनिक प्रदर्शन प्राप्त होता है।

Yunheng Wang, Yuetong Fang, Taowen Wang, Lusong Li, Kun Liu, Junzhe Xu, Zizhao Yuan, Yixiao Feng, Jiaxi Zhang, Wei Lu, Z (…)2026-05-14
💬 NLP

FIND: Toward Multimodal Financial Reasoning and Question Answering for Indic Languages

यह शोध पत्र छह भारतीय भाषाओं में वित्तीय तर्क के लिए एक व्यापक बहुभाषी बेंचमार्क, FinVQA का परिचय देता है, और FIND का प्रस्ताव करता है, जो उच्च-जोखिम वाले वित्तीय संदर्भों में मल्टीमॉडल और संख्यात्मक तर्क को बढ़ाने के लिए सुपरवाइज्ड फाइन-ट्यूनिंग को बाधा-जागरूक डिकोडिंग (constraint-aware decoding) के साथ जोड़ता है।

Sarmistha Das, Vaibhav Vishal, Syed Ibrahim Ahmad, Manish Gupta, Sriparna Saha2026-05-14
💬 NLP

LLM-Based Persuasion Enables Guardrail Override in Frontier LLMs

यह शोध पत्र प्रदर्शित करता है कि फ्रंटियर-क्लास LLMs को सिम्युलेटेड उपयोगकर्ताओं के रूप में कार्य करने वाले अन्य LLMs द्वारा व्यवस्थित रूप से उनके सुरक्षा गार्डरेल्स को बायपास करने और होलोकॉस्ट के खंडन और जलवायु परिवर्तन जैसे संवेदनशील विषयों पर हानिकारक सामग्री उत्पन्न करने के लिए राजी किया जा सकता है, जो केवल प्राकृतिक भाषा के तर्कों का उपयोग करके कई मॉडल पेयरिंग में उच्च सफलता दर प्राप्त करता है।

Rodrigo Nogueira, Thales Sales Almeida, Giovana Kerche Bonás, Andrea Roque, Ramon Pires, Hugo Abonizio, Thiago Laitz, Ce (…)2026-05-14
💬 NLP

Probing Persona-Dependent Preferences in Language Models

यह शोध पत्र प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स के रेजिडुअल स्ट्रीम (residual stream) में एक साझा, कारण संबंधी "प्रेफरेंस वेक्टर" (preference vector) होता है जो विविध पर्सोनाज़, जिनमें मददगार सहायकों और दुष्ट पात्रों जैसे विपरीत प्राथमिकताओं वाले पात्र भी शामिल हैं, के बीच कार्यों के चयन को नियंत्रित करता है।

Oscar Gilg, Pierre Beckmann, Daniel Paleka, Patrick Butlin2026-05-14