🤖 machine learning

Tokenization Tradeoffs in Structured EHR Foundation Models

यह शोध पत्र यह प्रदर्शित करता है कि टोकनाइजेशन रणनीतियों को अनुकूलित करना—विशेष रूप से इवेंट और पोजीशनल टाइम एनकोडिंग को एकल टोकन में संयोजित करके—विविध नैदानिक कार्यों में इलेक्ट्रॉनिक हेल्थ रिकॉर्ड फाउंडेशन मॉडल्स के प्रेडिक्टिव प्रदर्शन और कम्प्यूटेशनल दक्षता दोनों में महत्वपूर्ण सुधार करता है।

Lin Lawrence Guo, Santiago Eduardo Arciniegas, Joseph Jihyung Lee, Adam Paul Yan, George Tomlinson, Jason Fries, Lillian (…)2026-03-18
🤖 machine learning

Alternating Reinforcement Learning with Contextual Rubric Rewards

यह शोध पत्र अल्टरनेटिंग रीइन्फोर्समेंट लर्निंग विद रूब्रिक रिवॉर्ड्स (ARL-RR) प्रस्तुत करता है, जो एक ऐसा ढांचा है जो फिक्स्ड स्केलरलाइजेशन का उपयोग करने के बजाय एक समय में एक सिमेंटिक रूब्रिक मेटा-क्लास को गतिशील रूप से अनुकूलित करके मौजूदा तरीकों में सुधार करता है, जिससे रिवॉर्ड सहसंबंधों को कैप्चर किया जाता है और हेल्थबेंच डेटासेट पर बेहतर प्रदर्शन और दक्षता प्राप्त होती है।

Guangchen Lan2026-03-18
💬 NLP

Recursive Language Models Meet Uncertainty: The Surprising Effectiveness of Self-Reflective Program Search for Long Context

यह शोध पत्र SRLM को प्रस्तुत करता है, जो एक अनिश्चितता-जागरूक स्व-चिंतनशील ढांचा (uncertainty-aware self-reflective framework) है, जो पारंपरिक रिकर्सिव लैंग्वेज मॉडल्स की तुलना में बेहतर प्रदर्शन करता है क्योंकि यह स्व-संगति (self-consistency) और मौखिक रूप से व्यक्त आत्मविश्वास (verbalized confidence) जैसे आंतरिक संकेतों का उपयोग करके गतिशील रूप से संदर्भ-परस्पर क्रिया कार्यक्रमों (context-interaction programs) का चयन करता है, जिससे बिना किसी स्पष्ट पुनरावृत्ति तंत्र (explicit recursion mechanism) पर निर्भर हुए विविध कार्यों और संदर्भ लंबाईओं में महत्वपूर्ण प्रदर्शन लाभ प्राप्त होता है।

Keivan Alizadeh, Parshin Shojaee, Minsik Cho, Mehrdad Farajtabar2026-03-18
🤖 AI

Did You Check the Right Pocket? Cost-Sensitive Store Routing for Memory-Augmented Agents

यह शोधपत्र मेमोरी रिट्रीवल (स्मृति पुनर्प्राप्ति) को एक लागत-संवेदनशील स्टोर-रूटिंग समस्या के रूप में स्वरूपित करने का प्रस्ताव देता है ताकि मेमोरी-ऑगमेंटेड एजेंटों को विशिष्ट स्टोर्स को चुनिंदा रूप से क्वेरी करने में सक्षम बनाया जा सके, जिससे यूनिफॉर्म रिट्रीवल की तुलना में उत्तर की सटीकता और टोकन दक्षता दोनों में सुधार हो सके।

Madhava Gaikwad2026-03-18
🤖 AI

Persona-Conditioned Risk Behavior in Large Language Models: A Simulated Gambling Study with GPT-4.1

यह अध्ययन प्रदर्शित करता है कि GPT-4.1, जब एक सिम्युलेटेड जुआ वातावरण में विभिन्न सामाजिक-आर्थिक व्यक्तित्व सौंपे जाते हैं, तो स्वतः ही प्रॉस्पेक्ट थ्योरी (Prospect Theory) के अनुरूप जोखिम व्यवहार प्रदर्शित करता है—जैसे कि गरीब व्यक्तित्व का अमीर व्यक्तित्व की तुलना में काफी अधिक राउंड खेलना—जो यह सुझाव देता है कि शास्त्रीय संज्ञानात्मक आर्थिक पूर्वाग्रह केवल नकल नहीं किए गए हैं, बल्कि बड़े भाषा मॉडल (large language models) के भीतर अंतर्निहित रूप से समाहित हैं।

Sankalp Dubedy2026-03-18
💬 NLP

Temporal Fact Conflicts in LLMs: Reproducibility Insights from Unifying DYNAMICQA and MULAN

यह पुनरुत्पादकता अध्ययन DYNAMICQA और MULAN बेंचमार्क को एकीकृत करके LLMs की टेम्पोरल तथ्यों (temporal facts) को अपडेट करने की क्षमता के बारे में विरोधाभासी निष्कर्षों को सुलझाता है, जिससे यह पता चलता है कि निष्कर्ष डेटासेट डिज़ाइन, मूल्यांकन मेट्रिक्स और मॉडल आकार पर अत्यधिक निर्भर हैं, जिसमें MULAN के परिणाम पद्धतिगत ढांचों (methodological frameworks) में अधिक सामान्यीकरण योग्य सिद्ध होते हैं।

Ritajit Dey, Iadh Ounis, Graham McDonald, Yashar Moshfeghi2026-03-18
💬 NLP

CTG-DB: An Ontology-Based Transformation of ClinicalTrials.gov to Enable Cross-Trial Drug Safety Analyses

यह शोध पत्र CTG-DB को प्रस्तुत करता है, जो एक ओपन-सोर्स पाइपलाइन है जो ClinicalTrials.gov से विषम, टेक्स्ट-आधारित प्रतिकूल घटना (adverse event) डेटा को MedDRA शब्दावली के अनुरूप एक मानकीकृत, रिलेशनल डेटाबेस में परिवर्तित करती है ताकि स्केलेबल, पुनरुत्पादनीय क्रॉस-ट्रायल ड्रग सुरक्षा विश्लेषण सक्षम किया जा सके।

Jeffery L. Painter, François Haguinet, Andrew Bate2026-03-18
💬 NLP

BANGLASOCIALBENCH: A Benchmark for Evaluating Sociopragmatic and Cultural Alignment of LLMs in Bangladeshi Social Interaction

यह शोधपत्र BANGLASOCIALBENCH प्रस्तुत करता है, जो बांग्ला में सामाजिक-व्यावहारिक (sociopragmatic) क्षमता का मूल्यांकन करने के लिए 1,719 सांस्कृतिक रूप से आधारित उदाहरणों वाला पहला बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान बड़े भाषा मॉडल अपनी बहुभाषी प्रवाह के बावजूद भाषा के जटिल सामाजिक पदानुक्रमों, नातेदारी तर्क और संवादात्मक मानदंडों को समझने में व्यवस्थित रूप से विफल रहते हैं।

Tanvir Ahmed Sijan, S. M Golam Rifat, Pankaj Chowdhury Partha, Md. Tanjeed Islam, Md. Musfique Anwar2026-03-18
💬 NLP

POLAR:A Per-User Association Test in Embedding Space

POLAR एक नवीन प्रति-उपयोगकर्ता लेक्सिकल एसोसिएशन टेस्ट है जो एम्बेडिंग स्पेस में कार्य करता है ताकि लेखक-स्तरीय पूर्वाग्रहों और व्यवहारिक परिवर्तनों का पता लगाया जा सके, जो प्रभावी रूप से LLM-संचालित बॉट्स को ऑर्गेनिक अकाउंट्स से अलग करता है और ऑनलाइन समुदायों में चरमपंथी संरेखण को परिमाणित करता है।

Pedro Bento, Arthur Buzelin, Arthur Chagas, Yan Aquino, Victoria Estanislau, Samira Malaquias, Pedro Robles Dutenhefner (…)2026-03-18
💬 NLP

Robust Language Identification for Romansh Varieties

यह शोध पत्र एक नवीन SVM-आधारित भाषा पहचान प्रणाली प्रस्तुत करता है जो रोमांश (Romansh) की विभिन्न क्षेत्रीय बोलियों और सुप्रा-रीजनल रुमन्ट्स ग्रिशुन (Rumantsch Grischun) के बीच अंतर करने में सक्षम है, जिसने इडियम-अवेयर स्पेल चेकिंग और मशीन ट्रांसलेशन जैसे अनुप्रयोगों को सक्षम करने के लिए एक नए क्यूरेटेड बेंचमार्क पर 97% औसत सटीकता प्राप्त की है।

Charlotte Model, Sina Ahmadi, Jannis Vamvas2026-03-18