💬 NLP

Language Models Learn Universal Representations of Numbers and Here's Why You Should Care

यह शोध पत्र प्रदर्शित करता है कि विविध लार्ज लैंग्वेज मॉडल्स (LLMs) संख्याओं के लिए आश्चर्यजनक रूप से सार्वभौमिक और विनिमेय साइनुसोइडल (sinusoidal) निरूपणों पर अभिसरित होते हैं, जो संख्यात्मक एन्कोडिंग का सटीक मूल्यांकन करने और यांत्रिक संवर्द्धनों के माध्यम से अंकगणितीय त्रुटियों को कम करने के लिए एक महत्वपूर्ण निष्कर्ष है।

Michal Štefánik, Timothee Mickus, Marek Kadlčík, Bertram Højer, Michal Spiegel, Raúl Vázquez, Aman Sinha, Josef Kuchař (…)2026-04-23
💻 computer science

The OpenHands Software Agent SDK: A Composable and Extensible Foundation for Production Agents

यह शोध पत्र OpenHands सॉफ्टवेयर एजेंट SDK प्रस्तुत करता है, जो एक पुनर्गठित टूलकिट है जो लचीले कार्यान्वयन, सुरक्षित सैंडबॉक्स्ड निष्पादन और विविध मानव संपर्क इंटरफेस को एकीकृत करके उत्पादन-तैयार सॉफ्टवेयर विकास एजेंटों के निर्माण के लिए एक संयोजनीय और विस्तार योग्य आधार प्रदान करता है।

Xingyao Wang, Simon Rosenberg, Juan Michelini, Calvin Smith, Hoang Tran, Engel Nyst, Rohit Malhotra, Xuhui Zhou, Valerie (…)2026-04-23
💬 NLP

Efficient Test-Time Scaling of Multi-Step Reasoning by Probing Internal States of Large Language Models

यह शोध पत्र टेस्ट-टाइम स्केलिंग के लिए एक हल्का, प्रोब-आधारित तरीका प्रस्तावित करता है जो फ्रोजन लार्ज लैंग्वेज मॉडल्स की आंतरिक अवस्थाओं का विश्लेषण करके मल्टी-स्टेप रीजनिंग को सत्यापित करता है, जिससे बिना किसी महंगी एनोटेशन के, बहुत बड़े प्रोसेस रिवॉर्ड मॉडल्स के तुलनीय या उनसे बेहतर प्रदर्शन प्राप्त होता है।

Jingwei Ni, Ekaterina Fadeeva, Tianyi Wu, Mubashara Akhtar, Jiaheng Zhang, Elliott Ash, Markus Leippold, Timothy Baldwin (…)2026-04-23
💻 computer science

AnatomicalNets: A Multi-Structure Segmentation and Contour-Based Distance Estimation Pipeline for Clinically Grounded Lung Cancer T-Staging

यह शोध पत्र AnatomicalNets को प्रस्तुत करता है, जो एक पारदर्शी, बहु-चरणीय पाइपलाइन है जो एंड-टू-एंड वर्गीकरण को ट्यूमर के आयामों और शारीरिक निकटता पर समर्पित सेग्मेंटेशन नेटवर्क और नियत, नियम-आधारित अनुमान (rule-based inference) के संयोजन वाले नैदानिक रूप से आधारित दृष्टिकोण से बदलकर फेफड़ों के कैंसर के टी-स्टेजिंग (T-staging) की सटीकता को 91.36% तक सुधारती है।

Saniah Kayenat Chowdhury, Rusab Sarmun, Muhammad E. H. Chowdhury, Sohaib Bassam Zoghoul, Israa Al-Hashimi, Adam Mushtak (…)2026-04-23
💻 computer science

Same Content, Different Answers: Cross-Modal Inconsistency in MLLMs

यह शोध पत्र REST और REST+ बेंचमार्क प्रस्तुत करता है ताकि व्यवस्थित रूप से यह प्रदर्शित किया जा सके कि अत्याधुनिक मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स, इमेज, टेक्स्ट और मिश्रित मोडैलिटीज के माध्यम से समान अर्थपूर्ण जानकारी को संसाधित करते समय महत्वपूर्ण क्रॉस-मोडल विसंगति प्रदर्शित करते हैं, जो केवल टेक्स्ट रिकग्निशन त्रुटियों के बजाय दृश्य विशेषताओं और टोकन गणनाओं से प्रभावित एक घटना है।

Angela van Sprang, Laurens Samson, Ana Lucic, Erman Acar, Sennay Ghebreab, Yuki M. Asano2026-04-23
🤖 machine learning

Epistemology gives a Future to Complementarity in Human-AI Interactions

यह शोध पत्र मानव-एआई पूरकता (human-AI complementarity) की सैद्धांतिक और अनुभवजन्य सीमाओं को कम्प्यूटेशनल रिलायबिलिज्म (computational reliabilism) के ज्ञानमीमांसीय परिप्रेक्ष्य के माध्यम से पुनर्गठित करते हुए इसे संबोधित करता है, और यह तर्क देता है कि इसे निर्णय लेने में बेहतर मार्गदर्शन करने तथा डिजाइन और शासन प्रथाओं को सूचित करने के लिए एक विश्वसनीय ज्ञानमीमांसीय प्रक्रिया के प्रमाण के रूप में कार्य करना चाहिए।

Andrea Ferrario, Alessandro Facchini, Juan M. Durán2026-04-23
🤖 AI

Hebbian Learning with Global Direction

यह शोध पत्र ग्लोबल-गाइडेड हेबियन लर्निंग (GHL) प्रस्तुत करता है, जो एक जैविक रूप से सुसंगत ढांचा है जो एक वैश्विक साइन-आधारित संकेत के साथ स्थानीय ओजा नियम को एकीकृत करके पारंपरिक हेबियन विधियों की स्केलेबिलिटी सीमाओं को दूर करता है, जिससे इमेजनेट जैसे बड़े पैमाने के डेटासेट पर प्रतिस्पर्धी प्रदर्शन प्राप्त होता है और बैकप्रोपैगेशन के साथ अंतर को महत्वपूर्ण रूप से कम किया जाता है।

Wenjia Hua, Kejie Zhao, Luziwei Leng, Ran Cheng, Yuxin Ma, Qinghai Guo2026-04-23
💬 NLP

Agnostic Language Identification and Generation

यह शोध पत्र भाषा पहचान और निर्माण में 'स्ट्रॉन्ग रियलाइज़ेबिलिटी' (strong realizability) धारणा को उन एग्नोस्टिक उद्देश्यों (agnostic objectives) का प्रस्ताव देकर शिथिल करता है जो इनपुट डेटा वितरणों पर कोई प्रतिबंध नहीं लगाते हैं, जिससे इन कार्यों के लिए नवीन लक्षण वर्णन और लगभग सटीक सांख्यिकीय दरें प्राप्त होती हैं।

Mikael Møller Høgsgaard, Chirag Pabbaraju2026-04-23
💻 computer science

Computing the Reachability Value of Posterior-Deterministic POMDPs

यह शोध पत्र पोस्टीरियर-डिटरमिनिस्टिक POMDPs को प्रस्तुत करता है, जो एक नया वर्ग है जहाँ अगला राज्य वर्तमान राज्य, क्रिया और अवलोकन द्वारा विशिष्ट रूप से निर्धारित होता है, और यह प्रदर्शित करता है कि इस वर्ग के लिए, लक्ष्य अवस्थाओं तक पहुँचने की अधिकतम प्रायिकता को अनिश्चित शुद्धता तक अनुमानित किया जा सकता है, जिससे मानक POMDPs में पहुँच योग्यता (reachability) समस्याओं की सामान्य अनिर्णय क्षमता (undecidability) और जटिलता (intractability) पर विजय प्राप्त होती है।

Nathanaël Fijalkow, Arka Ghosh, Roman Kniazev, Guillermo A. Pérez, Pierre Vandenhove2026-04-23
🤖 AI

PlotChain: Deterministic Checkpointed Evaluation of Multimodal LLMs on Engineering Plot Reading

यह शोध पत्र PlotlyChain को प्रस्तुत करता है, जो एक नियतात्मक (deterministic), जनरेटर-आधारित बेंचमार्क है जिसमें सटीक ग्राउंड ट्रुथ और इंटरमीडिएट चेकपॉइंट्स के साथ 450 इंजीनियरिंग प्लॉट्स शामिल हैं, जो यह प्रकट करता है कि जहाँ शीर्ष मल्टीमॉडल LLMs मानक प्लॉट्स को पढ़ने में लगभग 80% सटीकता प्राप्त करते हैं, वहीं वे FFT और बैंडपास रिस्पॉन्स जैसे फ्रीक्वेंसी-डोमेन कार्यों के साथ काफी संघर्ष करते हैं।

Mayank Ravishankara2026-04-23