💬 NLP

The production of meaning in the processing of natural language

यह शोध पत्र विभिन्न पैमानों और बेंचमार्क में CHSH S|S| पैरामीटर का विश्लेषण करके बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) की क्वांटम-समान संदर्भपरकता (क्वांटम-लाइक कॉन्टेक्स्टुअलिटी) की जांच करता है, जो यह प्रकट करता है कि यह मीट्रिक मानक प्रदर्शन मापों के लंबवत (ऑर्थोगोनल) है और प्रॉम्प्ट इंजेक्शन सुरक्षा तथा व्याख्यात्मक संदर्भों के मौलिक हेरफेर के लिए गहन सूचना-सैद्धांतिक निहितार्थों को उजागर करता है।

Christopher J. Agostino, Quan Le Thien, Nayan D'Souza, Louis van der Elst2026-03-24
🤖 machine learning

Putnam 2025 Problems in Rocq using Opus 4.6 and Rocq-MCP

यह शोध पत्र रिपोर्ट करता है कि क्लॉड ओपस 4.6 (Claude Opus 4.6) ने, रॉक (Rocq) प्रूफ असिस्टेंट के लिए मॉडल कॉन्टेक्स्ट प्रोटोकॉल टूल्स और एक "कंपाइल-फर्स्ट, इंटरैक्टिव-फालबैक" रणनीति का उपयोग करते हुए, एक ऑफलाइन वातावरण में 2025 की पुटनाम गणितीय प्रतियोगिता (Putnam Mathematical Competition) की 12 में से 10 समस्याओं को स्वायत्त रूप से हल किया।

Guillaume Baudart, Marc Lelarge, Tristan Stérin, Jules Viennot2026-03-24
⚡ electrical engineering

ALICE: A Multifaceted Evaluation Framework of Large Audio-Language Models' In-Context Learning Ability

यह शोध पत्र ALICE को प्रस्तुत करता है, जो यह प्रकट करता है कि जबकि इन-कॉन्टेक्स्ट लर्निंग उदाहरण लार्ज ऑडियो-लैंग्वेज मॉडल्स को आउटपुट फॉर्मेट का पालन करने में मदद करते हैं, वे लगातार मुख्य कार्य प्रदर्शन को बढ़ाने में विफल रहते हैं, और अक्सर उसे कम कर देते हैं, जो ऑडियो-कंडीशन्ड प्रदर्शनों से क्रॉस-मोडल सिमेंटिक ग्राउंडिंग का लाभ उठाने की मॉडल्स की क्षमता में एक महत्वपूर्ण सीमा का संकेत देता है।

Yen-Ting Piao, Jay Chiehen Liao, Wei-Tang Chien, Toshiki Ogimoto, Shang-Tse Chen, Yun-Nung Chen, Chun-Yi Lee, Shao-Yuan (…)2026-03-24
💬 NLP

Policies Permitting LLM Use for Polishing Peer Reviews Are Currently Not Enforceable

यह शोध पत्र यह प्रदर्शित करता है कि वर्तमान एआई-टेक्स्ट डिटेक्टर (AI-text detectors) पीयर रिव्यू में एलएलएम (LLM) के उपयोग की पहचान करने के लिए लागू करने योग्य नहीं हैं क्योंकि वे अक्सर एआई द्वारा पॉलिश किए गए मानव-लिखित समीक्षाओं को पूरी तरह से एआई-जनरेटेड के रूप में गलत वर्गीकृत करते हैं, जिससे अकादमिक कदाचार के झूठे आरोपों और नीति उल्लंघन के अविश्वसनीय अनुमानों की स्थिति उत्पन्न होती है।

Rounak Saha, Gurusha Juneja, Dayita Chaudhuri, Naveeja Sajeevan, Nihar B Shah, Danish Pruthi2026-03-24
💬 NLP

Diffutron: A Masked Diffusion Language Model for Turkish Language

यह शोध पत्र Diffutron को प्रस्तुत करता है, जो विशेष रूप से रूपात्मक रूप से समृद्ध तुर्की भाषा के लिए डिज़ाइन किया गया एक संसाधन-कुशल मास्क्ड डिफ्यूजन लैंग्वेज मॉडल है, जो LoRA-आधारित निरंतर प्री-ट्रेनिंग और प्रगतिशील निर्देश-ट्यूनिंग के माध्यम से बहुत बड़े ऑटोरेग्रेसिव बेसलाइनों के विरुद्ध प्रतिस्पर्धी प्रदर्शन प्राप्त करता है।

Şuayp Talha Kocabay, Talha Rüzgar Akkuş2026-03-24
💬 NLP

PARHAF, a human-authored corpus of clinical reports for fictitious patients in French

यह शोधपत्र PARHAF को प्रस्तुत करता है, जो 18 विशेषज्ञताओं में 5,000 से अधिक रोगी मामलों को कवर करने वाली 7,394 विशेषज्ञ-लिखित, काल्पनिक फ्रांसीसी नैदानिक रिपोर्टों का एक विशाल ओपन-सोर्स कॉर्पस है, जिसे सख्त डेटा संरक्षण नियमों का पालन करते हुए नैदानिक प्राकृतिक भाषा प्रसंस्करण प्रणालियों के गोपनीयता-संरक्षित प्रशिक्षण और मूल्यांकन को सक्षम करने के लिए डिज़ाइन किया गया है।

Xavier Tannier, Salam Abbara, Rémi Flicoteaux, Youness Khalil, Aurélie Névéol, Pierre Zweigenbaum, Emmanuel Bacry2026-03-24
💬 NLP

Measuring Reasoning Trace Legibility: Can Those Who Understand Teach?

यह शोध पत्र तर्क देता है कि रीजनिंग लैंग्वेज मॉडल्स का मूल्यांकन केवल उत्तर की शुद्धता पर ही नहीं, बल्कि उनके रीजनिंग ट्रेसेस (तर्क पथों) की सुपाठ्यता पर भी किया जाना चाहिए, जिसमें "ट्रांसफर यूटिलिटी" को एक मीट्रिक के रूप में पेश किया गया है और यह खुलासा किया गया है कि शीर्ष प्रदर्शन करने वाले मॉडल अक्सर कम सुपाठ्य ट्रेसेस उत्पन्न करते हैं, क्योंकि वर्तमान प्रशिक्षण विधियों में सुपाठ्यता के लिए कोई अंतर्निहित पुरस्कार नहीं है।

Dani Roytburg, Shreya Sridhar, Daphne Ippolito2026-03-24
💬 NLP

Epistemic Observability in Language Models

यह शोध पत्र यह प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स (LLMs) में स्व-रिपोर्ट की गई आत्मविश्वास की दर सटीकता के व्युत्क्रमानुपाती है और यह सिद्ध करता है कि केवल टेक्स्ट-आधारित अवलोकन विश्वसनीय रूप से मतिभ्रम (hallucinations) का पता नहीं लगा सकता है, बल्कि इसके स्थान पर यह प्रति-टोकन एंट्रॉपी (per-token entropy) को सत्यापन संसाधन आवंटन को अनुकूलित करने के लिए एक सुदृढ़, आर्किटेक्चर-सामान्य सिग्नल के रूप में प्रस्तावित करता है।

Tony Mason2026-03-24
💬 NLP

JUBAKU: An Adversarial Benchmark for Exposing Culturally Grounded Stereotypes in Japanese LLMs

यह शोध पत्र JUBAKU को प्रस्तुत करता है, जो जापानी बड़े भाषा मॉडलों (LLMs) में अंतर्निहित सामाजिक पूर्वाग्रहों को उजागर करने के लिए मूल जापानी एनोटेटरों द्वारा हस्तनिर्मित एक सांस्कृतिक रूप से आधारित प्रतिकूल बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान मॉडल अनुवादित अंग्रेजी बेंचमार्क की तुलना में सांस्कृतिक रूप से विशिष्ट रूढ़ियों पर काफी खराब प्रदर्शन करते हैं।

Taihei Shiotani, Masahiro Kaneko, Ayana Niwa, Yuki Maruyama, Daisuke Oba, Masanari Ohi, Naoaki Okazaki2026-03-24
💬 NLP

A Modular LLM Framework for Explainable Price Outlier Detection

यह शोध पत्र एक मॉड्यूलर, एजेंटिक लार्ज लैंग्वेज मॉडल फ्रेमवर्क प्रस्तावित करता है जो प्रासंगिक समान वस्तुओं को वर्गीकृत करके, उनके प्रमुख गुणों के आधार पर उनकी सापेक्ष उपयोगिता का आकलन करके और इन तुलनाओं के माध्यम से तर्क देकर उत्पाद मूल्य आउटलेयर्स (outliers) का पता लगाता है और उनकी व्याख्या करता है, जिससे मानव ऑडिटरों के साथ 75% से अधिक सहमति प्राप्त होती है और मौजूदा ज़ीरो-शॉट और रिट्रीवल-आधारित विधियों को पीछे छोड़ दिया जाता है।

Shadi Sartipi, John Wu, Sina Ghotbi, Nikhita Vedula, Shervin Malmasi2026-03-24