💬 NLP

Hidden Decoding at Scale: Latent Computation Scaling for Large Language Models

यह शोध पत्र हिडन डिकोडिंग (Hidden Decoding) को प्रस्तुत करता है, जो एक नवीन स्केलिंग विधि है जो स्ट्रीम फैक्टराइजेशन के माध्यम से अनुक्रम-लंबाई (sequence-length) आयाम के साथ टोकन गणना का विस्तार करके लार्ज लैंग्वेज मॉडल्स को उन्नत करती है, जिससे फिक्स्ड ट्रांसफार्मर बैकबोन को संशोधित किए बिना या अत्यधिक प्रशिक्षण लागतों के बिना फ्रंटियर स्केल्स पर महत्वपूर्ण प्रदर्शन लाभ सक्षम होता है।

Aiwei Liu, Cheng Shi, Chuhan Wu, Ci Lei, Di Lu, Donald He, Fan Zhang, Fanhao Kong, Feifei Zhang, Guan Wang, Haicheng Wan (…)2026-07-10
💬 NLP

Best-of-NN TTS Evaluation is Confounded by ASR Family Alignment

यह शोध पत्र प्रकट करता है कि ASR सत्यापनकर्ताओं का उपयोग करके किया जाने वाला Best-of-NN TTS मूल्यांकन परिवार-स्तरीय संरेखण पूर्वाग्रहों (family-level alignment biases) से काफी हद तक प्रभावित होता है, और अधिक सुदृढ़ एवं सटीक सामग्री निरंतरता मेट्रिक्स प्राप्त करने के लिए क्रॉस-फैमिली रैंक एन्सेम्बल्स (cross-family rank ensembles) का प्रस्ताव करता है।

Taehyung Yu, Seongjae Kang2026-07-10
💰 quantitative finance

Grounded Event Extraction from SEC 8-K Filings with a Fine-Grained Taxonomy

यह शोध पत्र SEC 8-K फाइलिंग के लिए एक दो-चरणीय, सूक्ष्म-स्तरीय (fine-grained) इवेंट एक्सट्रैक्शन सिस्टम प्रस्तुत करता है जो वर्बेटिम उद्धरणों (verbatim citations) और कैलिब्रेटेड गुणवत्ता स्कोर के साथ 600,000 से अधिक ग्राउंडेड इवेंट टैग उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जो यह प्रदर्शित करता है कि ये लेबल आर्थिक रूप से भिन्न घटनाओं को अलग कर सकते हैं और गुणवत्ता द्वारा फ़िल्टर किए जाने पर उच्च परिशुद्धता प्राप्त कर सकते हैं।

Rian Dolphin, Joe Dursun, Jarrett Blankenship, Katie Adams, Quinton Pike2026-07-10
💬 NLP

Echoes Across Vietnam's Highlands, Delta, and Coast: A Multilingual Corpus for Cham, Khmer, and Tay-Nung

यह शोध पत्र CKTN को प्रस्तुत करता है, जो वियतनाम की चाम, खमेर और ताय-नुंग भाषाओं के लिए पहला बहुभाषी कॉर्पस और बेंचमार्क है, यह प्रदर्शित करते हुए कि लिपि और संपर्क अंतरों के कारण मानक अनुकूलन विधियाँ विफल हो जाती हैं और एक लिपि-जागरूक प्रीट्रेनिंग रेसिपी का प्रस्ताव देता है जो एनकोडर प्रदर्शन और सिमेंटिक सामान्यीकरण में महत्वपूर्ण सुधार करती है।

Anh Trac Duc Dinh, Khang Nhat Hoang Vo, Vinh Cong Doan, Tai Tien Ta, Khoa Duc Anh Lam2026-07-10✓ Author reviewed
💬 NLP

Towards Mechanistically Understanding Why Memorized Knowledge Fails to Generalize in Large Language Model Finetuning

यह शोध पत्र फाइन-ट्यून्ड लार्ज लैंग्वेज मॉडल्स में "जानने-उपयोग करने के अंतराल" (Knowing–Using Gap) की जांच करता है, जहाँ याद किया गया ज्ञान सामान्यीकरण करने में विफल रहता है, और एक सेल्फ-पैचिंग हस्तक्षेप का उपयोग करके यह प्रकट करता है कि मिसअलाइन्ड आंतरिक ज्ञान सर्किट प्रभावी तर्क को रोकते हैं, तथा एक ह्यूरिस्टिक रणनीति प्रस्तावित करता है जो 58–75% संभावित सामान्यीकरण प्रदर्शन को पुनः प्राप्त करती है।

Lu Dai, Ziyang Rao, Yili Wang, Hanqing Wang, Hao Liu, Hui Xiong2026-07-10
💬 NLP

When Synthetic Speech Is All You Have: Better Call GRPO

यह शोध पत्र प्रदर्शित करता है कि ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइजेशन (GRPO), केवल सिंथेटिक स्पीच का उपयोग करके विनियमित डोमेन में लार्ज लैंग्वेज मॉडल-आधारित ऑटोमैटिक स्पीच रिकग्निशन को अनुकूलित करने में सुपरवाइज्ड फाइन-ट्यूनिंग की तुलना में काफी बेहतर प्रदर्शन करता है, जिससे शुरुआती-परत के निरूपण (early-layer representations) को बदलने के बजाय स्टॉपिंग कैलिब्रेशन और अटेंशन अलाइनमेंट जैसे व्यवहार संबंधी पहलुओं में सुधार करके वर्ड एरर रेट में 45% की सापेक्ष कमी प्राप्त होती है।

Shashi Kumar, Yanis Labrak, Hasindri Watawana, Sergio Burdisso, Esaú Villatoro-Tello, Kadri Hacioğlu, Petr Motlicek, And (…)2026-07-10
💬 NLP

Detecting Ladder Logic Bombs in IEC 61131-3 PLC Programs using ESBMC-PLC+: A Formal Verification Approach with Trigger Synthesis

यह शोध पत्र ESBMC-LLB प्रस्तुत करता है, जो एक औपचारिक सत्यापन ढांचा (formal verification framework) है जो IEC 61131-3 PLC प्रोग्रामों में लैडर लॉजिक बमों (Ladder Logic Bombs) का पता लगाने के लिए ESBMC-PLC+ का विस्तार करता है, जो छिपे हुए फंक्शन-ब्लॉक लॉजिक को उजागर करके और ट्रिगर्स को सिंथेसाइज करके, सार्वजनिक डेटासेट्स पर मौजूदा तरीकों की विफलता के बावजूद, लगभग पूर्ण डिटेक्शन दर और अनुकूलनशील ट्रिगर्स (adaptive triggers) के विरुद्ध मजबूती प्राप्त करता है।

Pierre Dantas, Lucas Cordeiro, Waldir Junior2026-07-10
💬 NLP

Ensemble Diversity Optimization for Subjective Supervision

यह शोध पत्र एनसेंबल डायवर्सिटी ऑप्टिमाइज़ेशन (EDO) को प्रस्तुत करता है, जो एक डिफरेंशिएबल फ्रेमवर्क है जो एक साइन्ड डायवर्सिटी रेगुलराइज़र के माध्यम से एनसेंबल वेट्स, साइज और कैलिब्रेशन को संयुक्त रूप से अनुकूलित करता है ताकि व्यक्तिपरक एनएलपी कार्यों में एनोटेटर असहमति और अनिश्चितता को प्रभावी ढंग से मॉडल किया जा सके, जो कई बेंचमार्क में प्रोबेबिलिस्टिक कैलिब्रेशन और मानव वितरण के साथ संरेखण में महत्वपूर्ण सुधार प्रदर्शित करता है।

Xia Cui, Ziyi Huang, N. R. Abeynayake2026-07-10
💬 NLP

Cognitive-structured Multimodal Agent for Multimodal Understanding, Generation, and Editing

यह शोध पत्र एक संज्ञानात्मक-संरचित बहुविध एजेंट (Cognitive-structured Multimodal Agent) प्रस्तुत करता है जो संरचित अमूर्तीकरण और पुनर्प्राप्ति के साथ एक एपिसोडिक मेमोरी में दृश्य सूचना को बाह्य करके दीर्घ-अवधि वाले कार्यों में मोनोलिथिक एकीकृत मॉडलों की सीमाओं को दूर करता है, जो बड़े बेसलाइन की तुलना में बेहतर सटीकता और दक्षता प्राप्त करते हुए एक स्केलेबल टूल-ऑगमेंटेड परिनियोजन ढांचा प्रदान करता है।

Feng Wang, Canmiao Fu, Zhipeng Huang, Chen Li, Jing Lyu, Ge Li2026-07-10
💬 NLP

DominoTree: Conditional Tree-Structured Drafting with Domino for Speculative Decoding

DominoTree एक प्रशिक्षण-मुक्त, बेस्ट-फर्स्ट ट्री-स्ट्रक्चर्ड स्पेक्युलेटिव डिकोडिंग पद्धति पेश करता है जो विभिन्न बेंचमार्क और तापमानों में DFlash, DDTree और मूल Domino डिकोडर जैसे मौजूदा तरीकों की तुलना में बेहतर स्वीकृति लंबाई और थ्रूपुट प्राप्त करने के लिए Domino के कंडीशनल, नॉन-फ़ैक्टरिज़्ड सुधारों का लाभ उठाता है।

Saw S. Lin (Zhiqi Zhang), Jyh-Shing Roger Jang2026-07-10