💬 NLP

Candidate Attended Dialogue State Tracking Using BERT

यह शोध पत्र मल्टी-डोमेन डायलॉग स्टेट ट्रैकिंग के लिए एक नवीन, स्केलेबल फ्रेमवर्क प्रस्तुत करता है जो ज़ीरो-शॉट सामान्यीकरण प्राप्त करने के लिए एक प्री-ट्रेन्ड BERT मॉडल का लाभ उठाता है, जिससे कम या बिना प्रशिक्षण डेटा के नए डोमेन में त्वरित अनुकूलन सक्षम होता है और स्कीमा-गाइडेड डायलॉग (SGD) डेटासेट पर महत्वपूर्ण प्रदर्शन सुधार प्रदर्शित होता है।

Junyuan Zheng, Onkar Salvi, John Chan2026-07-20
💬 NLP

Frontier Language Models Struggle to Copy: Text Can Be Better Viewed in 2D

यह शोध पत्र यह प्रदर्शित करता है कि मानक 1D पोजीशनल एनकोडिंग की सीमाओं के कारण फ्रंटियर लैंग्वेज मॉडल्स टेक्स्ट को कॉपी करने में संघर्ष करते हैं, और 2D-RoPE का प्रस्ताव करता है, जो एक ऐसी विधि है जो टेक्स्ट को 2D ग्रिड में व्यवस्थित करती है ताकि सिंथेटिक और बड़े पैमाने के प्रीट्रेनिंग कार्यों दोनों में बेहतर कॉपी करने के प्रदर्शन और सामान्यीकरण को सक्षम किया जा सके।

Haodong Wen, Yiran Zhang, Yingfa Chen, Kaifeng Lyu2026-07-20
💬 NLP

Rate-Utility Frontiers for Language Encodings: Comparing Tokens, Bytes, and Pixels Under Controlled Linguistic Content

यह शोध पत्र यह स्थापित करता है कि कोई भी एकल भाषा एन्कोडिंग (टोकन, बाइट्स, या पिक्सेल) सार्वभौमिक रूप से प्रभावी नहीं है; इसके बजाय, इष्टतम विकल्प विशिष्ट कार्य, भाषा मिश्रण और क्षमता शासन द्वारा निर्धारित दर-उपयोगिता (rate-utility) के बीच के संतुलन पर निर्भर करता, जैसा कि नियंत्रित स्थितियों के तहत सतही रूप संरक्षण (surface form preservation), क्रॉस-लिंगुअल संरेखण (cross-lingual alignment), और विषय वर्गीकरण (topic classification) पर उनके प्रदर्शन की तुलना करके प्रकट किया गया है।

Ingo Ziegler, Martin Krebs, Desmond Elliott2026-07-20
💬 NLP

An Exam for Active Observers

यह शोध पत्र ActiveVision को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि वर्तमान मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स में सक्रिय दृश्य अवलोकन (active visual observation) करने की क्षमता मौलिक रूप से नहीं है, जैसा कि मानव प्रदर्शन की तुलना में पुनरावृत्ति संबंधी धारणा (iterative perception) की आवश्यकताओं वाले कार्यों पर उनकी लगभग पूर्ण विफलता से सिद्ध होता है।

Jiarui Zhang, Muzi Tao, Shangshang Wang, Ollie Liu, Xuezhe Ma, Willie Neiswanger2026-07-20
💬 NLP

Decoupled Alignment for Robust Plug-and-Play Adaptation

यह शोध पत्र DAPA को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त, प्लग-एंड-प्ले सुरक्षा संवर्धन विधि है जो ज्ञान आसवन (नॉलेज डिस्टिलेशन) और मॉडल फ्यूजन का लाभ उठाकर अच्छी तरह से संरेखित (वेल-अलाइन्ड) मॉडलों से शैडो-अलाइन्ड मॉडलों में संरेखण संकेतों को इंजेक्ट करती है, जिससे प्रदर्शन से समझौता किए बिना हानिकारक इनपुट के विरुद्ध रक्षा सफलता दर में उल्लेखनीय सुधार होता है।

Haozheng Luo, Jiahao Yu, Wenxin Zhang, Jialong Li, Chenghao Qiu, Yimin Wang, Eric Hanchen Jiang, Jerry Yao-Chieh Hu, Yan (…)2026-07-17
💬 NLP

Empirical evidence of Large Language Model's influence on human spoken communication

यह अध्ययन प्रमाणिक साक्ष्य प्रदान करता है कि चैटजीपीटी (ChatGPT) के विमोचन ने स्वाभाविक भाषण में विशिष्ट शब्दों की आवृत्ति बढ़ाकर मानव मौखिक संचार को कार्यवत रूप से प्रभावित किया है, जो यह दर्शाता है कि मनुष्य बड़े भाषा मॉडलों (large language models) के शाब्दिक पैटर्न को आत्मसात और अपना रहे हैं, जिससे वे सांस्कृतिक विकास की निरंतर प्रक्रिया में एआई (AI) को एकीकृत कर रहे हैं।

Hiromu Yakura, Ezequiel Lopez-Lopez, Levin Brinkmann, Ignacio de la Serna, Lara Kirfel, Prateek Gupta, Ivan Soraperra, T (…)2026-07-17
💬 NLP

PERL: Pinyin Enhanced Rephrasing Language Model for Chinese ASR N-best Error Correction

यह शोध पत्र PERL को प्रस्तुत करता है, जो एक पिनयिन-संवर्धित भाषा मॉडल है जो टोकन-वार गेटिंग के माध्यम से सिमेंटिक और फोनेटिक निरूपणों को संलयित करके और महत्वपूर्ण कैरेक्टर एरर रेट में कमी लाने के लिए मास्क बजटिंग तंत्र के माध्यम से सख्त लंबाई बाधाओं को लागू करके चीनी ASR N-सर्वश्रेष्ठ त्रुटि सुधार में सुधार करता है।

Junhong Liang, Bojun Zhang2026-07-17
💬 NLP

Step-Tagging: Toward controlling the generation of Language Reasoning Models through step monitoring

यह शोध पत्र स्टेप-टैगिंग (Step-Tagging) का परिचय देता है, जो एक नवीन रीजनिंग स्टेप टैक्सोनॉमी (ReasonType) का उपयोग करने वाला एक हल्का फ्रेमवर्क है ताकि लैंग्वेज रीजनिंग मॉडल्स की रियल-टाइम मॉनिटरिंग और अर्ली स्टॉपिंग को सक्षम बनाया जा सके, जिससे गणितीय और गैर-गणितीय बेंचमार्क में तुलनीय सटीकता बनाए रखते हुए टोकन जनरेशन में 20-50% की कमी हासिल की जा सके।

Yannis Belkhiter, Seshu Tirupathi, Giulio Zizzo, John D. Kelleher2026-07-17
💬 NLP

WavePhaseNet: A DFT-Based Method for Constructing Semantic Conceptual Hierarchy Structures (SCHS)

यह शोधपत्र WavePhaseNet का प्रस्ताव करता है, जो एक ऐसी विधि है जो डिस्क्रीट फूरियर ट्रांसफॉर्म के माध्यम से एक सिमेंटिक कॉन्सेप्चुअल पदानुक्रम संरचना (Semantic Conceptual Hierarchy Structure) का निर्माण करने के लिए माप सिद्धांत (measure theory) और आवृत्ति विश्लेषण (frequency analysis) के माध्यम से LLM अटेंशन मैकेनिज्म को पुनर्गठित करती है, जिससे मतिभ्रम (hallucinations) को कम करने और तार्किक निरंतरता को लागू करने के लिए आयामी न्यूनीकरण (dimensionality reduction) और कोहोमोलॉजिकल रेगुलराइजेशन (cohomological regularization) को सैद्धांतिक रूप से सक्षम बनाया जा सके।

Kiyotaka Kasubuchi, Kazuo Fukiya2026-07-17
💬 NLP

Quantum Compositional NLP for Arabic: Grammar, Morphology, and Word Sense in Circuit Topology

यह शोध पत्र अरबी के लिए प्रोग्रुप ग्रामर-आधारित क्वांटम कंपोजिशनल नेचुरल लैंग्वेज प्रोसेसिंग के पहले अनुप्रयोग को प्रस्तुत करता है, जो नियंत्रित प्रयोगों के माध्यम से यह प्रदर्शित करता है कि भाषा की रूपात्मक और वाक्यरचनात्मक संरचना को प्रतिबिंबित करने वाले क्वांटम सर्किट, AraVec और AraBERT जैसे शास्त्रीय बेसलाइन की तुलना में शब्द क्रम, काल और शब्द अर्थ विसंकेतन (word sense disambiguation) को प्रभावी ढंग से मॉडल कर सकते हैं।

Wajahath Mohammed2026-07-17