💬 NLP

CIRCUS: Circuit Consensus under Uncertainty via Stability Ensembles

CIRCUS एक पोस्ट-हॉक फ्रेमवर्क है जो स्थिरता एन्सेम्बल्स (stability ensembles) का निर्माण करके तंत्रिका सर्किट खोज (mechanistic circuit discovery) की विश्लेषक के मनमाने विकल्पों के प्रति संवेदनशीलता को संबोधित करता है, ताकि एक सुदृढ़, अनिश्चितता-जागरूक सर्वसम्मत सर्किट निकाला जा सके जो संक्षिप्तता और कारण संबंधी प्रासंगिकता दोनों में पारंपरिक बेसलाइनों से बेहतर प्रदर्शन करता है।

Swapnil Parekh2026-03-03
💬 NLP

QQ: A Toolkit for Language Identifiers and Metadata

यह शोध पत्र QwanQwa (QQ) को प्रस्तुत करता है, जो एक हल्का पायथन टूलकिट है जो बहुभाषी एनएलपी (NLP) अनुसंधान के लिए हजारों भाषाओं में पहचानकर्ता सामान्यीकरण (identifier normalization), मैपिंग और अन्वेषण को सरल बनाने हेतु विविध भाषा मेटाडेटा संसाधनों को एकीकृत करता है।

Wessel Poelman, Yiyi Chen, Miryam de Lhoneux2026-03-03
💬 NLP

TraceSIR: A Multi-Agent Framework for Structured Analysis and Reporting of Agentic Execution Traces

TraceSIR एक मल्टी-एजेंट फ्रेमवर्क है जो डेटा को कंप्रेस करने, सूक्ष्म-स्तरीय मूल कारण विश्लेषण (root cause analysis) करने और कार्रवाई योग्य रिपोर्ट तैयार करने के लिए विशिष्ट एजेंटों का उपयोग करके जटिल एजेंटिक निष्पादन ट्रेसेस (execution traces) के विश्लेषण की चुनौतियों का समाधान करता है, जो नए पेश किए गए TraceBench और ReportEval बेंचमार्क पर उत्कृष्ट प्रदर्शन प्रदर्शित करता है।

Shu-Xun Yang, Cunxiang Wang, Haoke Zhang, Wenbo Yu, Lindong Wu, Jiayi Gui, Dayong Yang, Yukuo Cen, Zhuoer Feng, Bosi Wen (…)2026-03-03
💬 NLP

SSKG Hub: An Expert-Guided Platform for LLM-Empowered Sustainability Standards Knowledge Graphs

एसएसकेजी हब (SSKG Hub) एक विशेषज्ञ-निर्देशित वेब प्लेटफॉर्म है जो जटिल स्थिरता मानकों को ऑडिट योग्य, उत्पत्ति-लिंक्ड ज्ञान ग्राफ में बदलने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिसमें एक कठोर बहु-चरणीय क्यूरेशन वर्कफ़्लो शामिल है जो भूमिका-आधारित शासन और विशेषज्ञ अधिनिर्णय के माध्यम से ट्रैसेबिलिटी और गुणवत्ता सुनिश्चित करता है।

Chaoyue He, Xin Zhou, Xinjia Yu, Lei Zhang, Yan Zhang, Yi Wu, Lei Xiao, Liangyue Li, Di Wang, Hong Xu, Xiaoqiao Wang, We (…)2026-03-03
💬 NLP

Constitutional Black-Box Monitoring for Scheming in LLM Agents

यह शोध पत्र प्रदर्शित करता है कि प्राकृतिक-भाषा व्यवहार विशिष्टताओं से उत्पन्न सिंथेटिक डेटा पर अनुकूलित LLM-आधारित संवैधानिक ब्लैक-बॉक्स मॉनिटर, यद्यपि सरल प्रॉम्प्ट स्वीप के साथ उनका प्रदर्शन तेजी से संतृप्त हो जाता है और व्यापक अनुकूलन से कोई और लाभ प्राप्त नहीं होता, फिर भी वे वास्तविक एजेंट वातावरण में योजनाबद्ध व्यवहार (scheming) का पता लगाने के लिए प्रभावी ढंग से सामान्यीकरण कर सकते हैं।

Simon Storf, Rich Barton-Cooper, James Peters-Gill, Marius Hobbhahn2026-03-03
💬 NLP

Learning Nested Named Entity Recognition from Flat Annotations

यह शोध पत्र प्रचुर मात्रा में उपलब्ध फ्लैट एनोटेशन से नेस्टेड नेमड एंटिटी रिकग्निशन सीखने की विधियों की जांच करता है, यह प्रदर्शित करते हुए कि स्ट्रिंग इंक्लूजन, एंटिटी करप्शन, फ्लैट न्यूट्रलाइजेशन और एलएलएम फाइन-ट्यूनिंग को संयोजित करने वाला एक हाइब्रिड दृष्टिकोण रूसी NEREL बेंचमार्क पर पूर्ण नेस्टेड सुपरविजन के प्रदर्शन अंतराल का 40% हिस्सा पाटने में सक्षम है।

Igor Rozhkov, Natalia Loukachevitch2026-03-03
💬 NLP

MedGPT-oss: Training a General-Purpose Vision-Language Model for Biomedicine

यह शोध पत्र MEDGPT-OSS को प्रस्तुत करता है, जो एक ओपन-वेट 20B-पैरामीटर विजन-लैंग्वेज मॉडल है जो जटिल मल्टीमॉडल और टेक्स्ट-ओनली कार्यों पर बड़े ओपन मेडिकल मॉडल्स से बेहतर प्रदर्शन करते हुए, गोपनीयता-संरक्षित, ऑन-प्रिमाइसेस उपयोग के लिए उपयुक्त पैरामीटर-कुशल फुटप्रिंट बनाए रखते हुए क्लिनिकल एआई में परिनियोजन अंतराल (डिप्लॉयमेंट गैप) को पाटता है।

Kai Zhang, Zhengqing Yuan, Cheng Peng, Songlin Zhao, Mengxian Lyu, Ziyi Chen, Yanfang Ye, Wei Liu, Ying Zhang, Kaleb E S (…)2026-03-03
💬 NLP

CHIMERA: Compact Synthetic Data for Generalizable LLM Reasoning

यह शोधपत्र CHIMERA को प्रस्तुत करता है, जो 9K उच्च-गुणवत्ता वाले, क्रॉस-डोमेन रीजनिंग नमूनों का एक संक्षिप्त, पूर्णतः स्वचालित सिंथेटिक डेटासेट है, जो कोल्ड-स्टार्ट, डोमेन कवरेज और एनोटेशन बॉटलनेक चुनौतियों पर विजय प्राप्त करके एक छोटे 4B मॉडल को बहुत बड़े फ्रंटियर मॉडल्स के तुलनीय रीजनिंग प्रदर्शन प्राप्त करने में सक्षम बनाता है।

Xinyu Zhu, Yihao Feng, Yanchao Sun, Xianzhi Du, Pingzhi Li, Olli Saarikivi, Yun Zhu, Yu Meng2026-03-03
💬 NLP

Hybrid Neural-LLM Pipeline for Morphological Glossing in Endangered Language Documentation: A Case Study of Jungar Tuvan

यह शोध पत्र लुप्तप्राय जुंगार तुवन भाषा के स्वचालित इंटरलिनियर ग्लॉसिंग के लिए एक हाइब्रिड न्यूरल-एलएलएम (LLM) पाइपलाइन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि बी-एलएसटीएम-सीआरएफ (BiLSTM-CRF) सीक्वेंस लेबलिंग मॉडल को एलएलएम पोस्ट-करेक्शन के साथ संयोजित करने से एनोटेशन कार्यभार में काफी कमी आती है और ऐसे डिजाइन सिद्धांत स्थापित करता है जैसे कि कम संसाधन वाली रूपात्मक रूप से समृद्ध भाषाओं के लिए डिक्शनरी-आधारित दृष्टिकोणों की तुलना में रिट्रीवल-ऑगमेंटेड प्रॉम्प्टिंग की श्रेष्ठता।

Siyu Liang, Talant Mawkanuli, Gina-Anne Levow2026-03-03
💬 NLP

The Aftermath of DrawEduMath: Vision Language Models Underperform with Struggling Students and Misdiagnose Errors

यह शोध पत्र प्रदर्शित करता है कि वर्तमान विजन-लैंग्वेज मॉडल हस्तलिखित छात्र कार्यों का विश्लेषण करते समय काफी खराब प्रदर्शन करते हैं, विशेष रूप से संघर्ष कर रहे शिक्षार्थियों द्वारा की जाने वाली त्रुटियों को पहचानने और निदान करने में, जो उनकी समस्या-समाधान क्षमताओं और शैक्षिक अनुप्रयोगों की विशिष्ट आवश्यकताओं के बीच एक महत्वपूर्ण अंतर को रेखांकित करता है।

Li Lucy, Albert Zhang, Nathan Anderson, Ryan Knight, Kyle Lo2026-03-03