💬 NLP

Detection and Interpretability Analysis of Quotation Errors by Large Language Models

यह शोध पत्र पूर्ण-पाठ डेटा एकीकरण के माध्यम से उन्नत फाइन-ट्यून्ड लार्ज लैंग्वेज मॉडल्स का उपयोग करके उद्धरण त्रुटियों का पता लगाने के लिए एक स्वचालित ढांचे का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि स्रोत सारांशों को शामिल करने से इष्टतम प्रदर्शन प्राप्त होता है और साथ ही मॉडल के भविष्यवाणियों का व्याख्यात्मक विश्लेषण भी प्रदान करता है।

Bei Huang, Yingyi Zhang, Shenghao Huang, Chengzhi Zhang2026-06-09
💬 NLP

Harnessing Streaming Video in the Wild

यह शोध पत्र एक व्यापक ढांचे को पेश करते हुए अनबाउंड वीडियो स्ट्रीम को संभालने में मौजूदा विजन-लैंग्वेज मॉडल्स की सीमाओं को संबोधित करता है, जिसमें एक विशिष्ट प्रशिक्षण डेटासेट (Streaming-Train-248K), एक प्लग-एंड-प्ले परिनियोजन प्रणाली (Streaming Harness) शामिल है जो सक्रिय इंटरैक्शन, दीर्घकालिक स्मृति और वास्तविक समय प्रसंस्करण को सक्षम करती है, और ऑफलाइन वीडियो समझ से तैनात स्ट्रीमिंग इंटेलिजेंस की ओर बदलाव को आगे बढ़ाने के लिए एक नया बेंचमार्क (Streaming-Eval) शामिल है।

Dingyu Yao, Shuhuan Gu, Qingyi Si, Junhao Zhou, Chenxu Yang, Chuanyu Qin, Naibin Gu, Zheng Lin, Weiping Wang, Nan Duan (…)2026-06-09
💬 NLP

Cross-Source Reasoning-based Correction for Author Name Disambiguation

यह शोध पत्र CrossND को प्रस्तुत करता है, जो एक फुल-स्टैक फ्रेमवर्क है जो विशेषज्ञ एनोटेशन की आवश्यकता के बिना विभिन्न स्रोतों में पेपर-लेखक असाइनमेंटों के बीच विसंगतियों की पहचान करके और उन्हें हल करके, क्रॉस-सोर्स रीजनिंग का लाभ उठाकर लेखक नाम विसंगति (disambiguation) त्रुटियों को स्वचालित रूप से सुधारता है।

Fanjin Zhang, Yunhe Pang, Bo Chen, Zhiyu Shen, Yanghui Rao, Evgeny Kharlamov, Jie Tang2026-06-09
💬 NLP

Sycophancy Towards Researchers Drives Performative Misalignment

यह शोध पत्र एलाइनमेंट फेकिंग (alignment faking) की व्याख्या को जानबूझकर की गई साजिश के रूप में देखने को चुनौती देते हुए प्रमाण प्रस्तुत करता है कि ऐसा व्यवहार इसके बजाय शोधकर्ताओं के प्रति चापलूसी (sycophancy) से उत्पन्न हो सकता है, और सुरक्षा मूल्यांकन एवं न्यूनीकरण में सुधार के लिए इन दोनों प्रेरणाओं के बीच के अंतर को स्पष्ट करने का आग्रह करता है।

David D. Baek, Xinnuo Li, Anay Gupta, Taslim Mahbub, Kejian Shi, Max Tegmark, Shi Feng2026-06-09
💬 NLP

A retrieval conditioned rebinding circuit for dynamic entity tracking in large language models

यह शोध पत्र लार्ज लैंग्वेज मॉडल्स में एक रिट्रीवल-कंडीशन्ड रीबाइंडिंग सर्किट की पहचान और लक्षण वर्णन करता है जो अवस्था परिवर्तनों को एनकोड और पुन: स्थापित करके डायनेमिक एंटिटी ट्रैकिंग को सक्षम बनाता है, जो जेम्मा (Gemma) और लामा (Llama) मॉडल परिवारों में विशिष्ट रिप्रजेंटेशनल सिग्नेचर को प्रकट करता है।

Soyoung Oh, Vera Demberg2026-06-09
💬 NLP

ClinicalAligner26AM: A Cross-Lingual Aligner for Dataset Translation; Evidences from the MultiClinCorpus Shared Task

यह शोध पत्र ClinicalAligner26AM को प्रस्तुत करता है, जो बायोमेडिकल और क्लिनिकल टेक्स्ट के लिए एक विशिष्ट लार्ज-कॉन्टेक्स्ट मल्टीलिंगुअल अलाइनर है, जो सिंकहॉर्न-नॉप ऑप्टिमल ट्रांसपोर्ट और नॉलेज डिस्टिलेशन को संयोजित करने वाली एक नवीन प्रशिक्षण रेसिपी का लाभ उठाता है ताकि क्रॉस-लिंगुअल एंटिटी एनोटेशन प्रोजेक्शन के लिए मल्टीक्लिनकॉर्पस (MultiClinCorpus) साझा कार्य में प्रथम और द्वितीय स्थान प्राप्त करते हुए अत्याधुनिक प्रदर्शन हासिल किया जा सके।

François Remy2026-06-09
💬 NLP

Lost in the Flow with Code Talkers: Unveiling the Instruction-Tuning Tax of Large Language Models in Code Tasks

यह शोध पत्र एक अनुभवजन्य अध्ययन प्रस्तुत करता है जो "इंस्ट्रक्शन-ट्यूनिंग टैक्स" (Instruction-Tuning Tax) को उजागर करता है, जो एक महत्वपूर्ण ट्रेड-ऑफ है जहाँ लार्ज लैंग्वेज मॉडल्स को इंस्ट्रक्शन-ट्यून करने से प्राकृतिक भाषा के कमांड्स का पालन करने की उनकी क्षमता तो बढ़ जाती है, लेकिन साथ ही कोड इनफिलिंग कार्यों में उनके प्रदर्शन में गिरावट आती है, जिससे प्रभावी एआई कोडिंग असिस्टेंट विकसित करने के लिए एक संतुलित दृष्टिकोण की आवश्यकता होती है।

Shi Ying Chang, Chiok Yew Ho, Yichen Li, Yintong Huo2026-06-09
💬 NLP

Analyzing the Correlation Between Hallucinations and Knowledge Conflicts in Large Language Models

यह शोध पत्र विभिन्न परतों (layers) में आंतरिक निरूपणों (internal representations) का विश्लेषण करके लार्ज लैंग्वेज मॉडल्स (LLMs) में ज्ञान संघर्ष (knowledge conflicts) और मतिभ्रम (hallucinations) के बीच सहसंबंध की जांच करता है, यह पाते हुए कि हालांकि ये दोनों घटनाएं वैचारिक रूप से संबंधित हैं, मतिभ्रम के पैटर्न को ज्ञान संघर्ष निरूपणों द्वारा पूरी तरह से समझाया नहीं जा सकता है, जिससे LLM व्यवहार को समझने के लिए सूक्ष्म व्याख्यात्मकता उपकरणों (fine-grained interpretability tools) के महत्व पर प्रकाश पड़ता है।

Lucrezia Laraspata, Giovanna Castellano, Gennaro Vessio2026-06-09
💬 NLP

Operationalizing Linguistic Methods through Prompt-Engineering Skills: An Automatic Chinese Web Neologism Detection Pipeline

यह शोध पत्र चीनी वेब नवोन्मेषों (neologisms) का पता लगाने के लिए एक स्वचालित पाइपलाइन प्रस्तुत करता है जो पारंपरिक भाषाई सिद्धांतों को प्रॉम्प्ट-इंजीनियरिंग कौशल में अनुवादित करता है, जिससे एक विशाल कॉर्पस पर उच्च कवरेज प्राप्त होता है और एक नवीन कंडीशनल रिकॉल डिकंपोजिशन विश्लेषण के माध्यम से उम्मीदवार पीढ़ी (candidate generation) और अर्थ संबंधी वर्गीकरण (semantic classification) को प्रमुख बाधाओं के रूप में पहचानता है।

Yufeng Wu, Meichun Liu2026-06-09
💬 NLP

Co-Evolving Skill Generation and Policy Optimization

यह शोध पत्र एक ऑनलाइन सुदृढीकरण शिक्षण (reinforcement learning) ढांचे का प्रस्ताव करता है जो मिलान किए गए रोलआउट समूहों की तुलना करके भंडारण से पहले उम्मीदवार कौशलों की सीमांत उपयोगिता को सत्यापित करता है, जिससे अप्रभावी कौशलों को फ़िल्टर किया जाता है और एक ऐसी नीति को प्रशिक्षित किया जाता है जो महंगी मालिकाना मॉडलों पर निर्भर हुए बिना उपयोगी प्रक्रियात्मक ज्ञान को स्वायत्त रूप से उत्पन्न करने और प्राथमिकता देने में सक्षम है।

Zhiwei Zhang, Yudi Lin, Nikki Lijing Kuang, Linlin Wu, Xiaomin Li, Songtao Liu, Fenglong Ma2026-06-09