💬 NLP

TDGNet: Hallucination Detection in Diffusion Language Models via Temporal Dynamic Graphs

TDGNet एक टेम्पोरल डायनेमिक ग्राफ फ्रेमवर्क है जिसे डिफ्यूजन लैंग्वेज मॉडल्स में टोकन-लेवल अटेंशन पैटर्न और सूचना के डीनोइजिंग प्रक्षेपवक्र (denoising trajectory) के दौरान विकसित होने के तरीके का विश्लेषण करके मतिभ्रम (hallucinations) का पता लगाने के लिए डिज़ाइन किया गया है।

Arshia Hemmat, Philip Torr, Yongqiang Chen, Junchi Yu2026-02-10
💬 NLP

Online Bayesian Imbalanced Learning with Bregman-Calibrated Deep Networks

यह शोध पत्र "ऑनलाइन बेयसियन इम्बैलेंस्ड लर्निंग" (OBIL) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो लाइकलीहुड-रेश्यो एस्टीमेशन को क्लास प्रायर्स से अलग करने के लिए ब्रेगमैन-कैलिब्रेटेड डीप नेटवर्क्स का उपयोग करता है, जिससे मॉडल पुन: प्रशिक्षण के बजाय सरल थ्रेशोल्ड समायोजन के माध्यम से वास्तविक समय के वितरण बदलावों (डिस्ट्रीब्यूशन शिफ्ट्स) के अनुकूल हो सकते हैं।

Zahir Alsulaimawi2026-02-10
💬 NLP

DIAL-SUMMER: A Structured Evaluation Framework of Hierarchical Errors in Dialogue Summaries

यह शोध पत्र DIAL-SUMMER प्रस्तुत करता है, जो एक संरचित मूल्यांकन ढांचा और एनोटेटेड डेटासेट है जिसे संवाद और टर्न-स्तर (within-turn level) दोनों पर त्रुटियों को वर्गीकृत करके संवाद सारांश की अनूठी जटिलताओं को संबोधित करने के लिए डिज़ाइन किया गया है।

Sahana Ramnath, Nima Chitsazan, Mingyang Zhou, Chia-Hsuan Lee, Shi-Xiong Zhang, Stephen Rawls, Sambit Sahu, Sangwoo Cho (…)2026-02-10
💬 NLP

NLP for Local Governance Meeting Records: A Focus Article on Tasks, Datasets, Metrics and Benchmark

यह केंद्रित लेख स्थानीय शासन की बैठक के अभिलेखों में विषमता और जटिलता की चुनौतियों को संबोधित करने के लिए दस्तावेज़ विभाजन (document segmentation), डोमेन-विशिष्ट इकाई निष्कर्षण (domain-specific entity extraction) और स्वचालित सारांशीकरण (automatic summarization) जैसे मौलिक एनएलपी (NLP) कार्यों की समीक्षा करता है, जिसका उद्देश्य उनकी सुलभता और पारदर्शिता को बढ़ाना है।

Ricardo Campos, José Pedro Evans, José Miguel Isidro, Miguel Marques, Luís Filipe Cunha, Alípio Jorge, Sérgio Nunes, Nun (…)2026-02-10
🧬 biology

DrugR: Optimizing Molecular Drugs through LLM-based Explicit Reasoning

DrugR एक LLM-आधारित आणविक अनुकूलन ढांचा (molecular optimization framework) है जो स्पष्ट, व्याख्यात्मक औषधीय तर्क के माध्यम से ADMET गुणों में सुधार करने के लिए डोमेन-विशिष्ट प्रीट्रेनिंग, रिवर्स डेटा इंजीनियरिंग और मल्टी-ग्रैनुलर सुदृढीकरण लर्निंग (reinforcement learning) का उपयोग करता है।

Haoran Liu, Zheni Zeng, Yukun Yan, Yuxuan Chen, Yunduo Xiao2026-02-10
💬 NLP

CoRect: Context-Aware Logit Contrast for Hidden State Rectification to Resolve Knowledge Conflicts

CoRect, रिट्रीवल-ऑगमेंटेड जनरेशन (Retrieval-Augmented Generation) में ज्ञान के संघर्षों को संबोधित करता है, जो एक लेबल-मुक्त, लॉजिट-कॉन्ट्रास्ट-आधारित हिडन स्टेट रेक्टिफिकेशन विधि के माध्यम से उन परतों की पहचान और सुधार करता है जहाँ पैरामीट्रिक प्रायोरिटीज़ (parametric priors) रिट्रीव किए गए संदर्भ को दबा देती हैं।

Xuhua Ma, Richong Zhang, Zhijie Nie2026-02-10
💬 NLP

Language Predicts Identity Fusion Across Cultures and Reveals Divergent Pathways to Violence

यह शोध पत्र संज्ञानात्मक भाषाविज्ञान और एलएलएम (LLM) का उपयोग करके भाषा के माध्यम से पहचान संलयन (identity fusion) को मापने की एक नई विधि प्रस्तुत करता है, जो यह प्रदर्शित करता है कि यह फ्यूजन स्कोर की सटीक भविष्यवाणी कर सकता है और चरमपंथी हिंसा के दो अलग-अलग मनोवैज्ञानिक मार्गों के बीच अंतर कर सकता है।

Devin R. Wright, Justin E. Lane, F. LeRon Shults2026-02-10
💬 NLP

Latent Reasoning with Supervised Thinking States

यह शोध पत्र "थिंकिंग स्टेट्स" (Thinking States) का प्रस्ताव करता है, जो इनपुट प्रोसेसिंग चरण के दौरान लेटेंट थॉट टोकन (latent thought tokens) को उत्पन्न और एम्बेड करके तर्क दक्षता और प्रदर्शन में सुधार करता है, जिससे पारंपरिक चेन-ऑफ-थॉट (Chain-of-Thought) की तुलना में समानांतर योग्य प्रशिक्षण और कम इन्फरेंस विलंबता (inference latency) संभव होती है।

Ido Amos, Avi Caciularu, Mor Geva, Amir Globerson, Jonathan Herzig, Lior Shani, Idan Szpektor2026-02-10
💬 NLP

ManifoldKV: Training-Free KV Cache Compression via Euclidean Outlier Detection

ManifoldKV एक ट्रेनिंग-फ्री KV कैश कंप्रेशन विधि है जो टोकन के कोणीय (angular) और परिमाण-आधारित (magnitude-based) महत्व दोनों को बेहतर ढंग से पकड़ने के लिए कोसाइन सिमिलरिटी (cosine similarity) के बजाय यूक्लिडियन डिस्टेंस (Euclidean distance) का उपयोग करके लॉन्ग-कॉन्टेक्स्ट इन्फरेंस सटीकता में सुधार करती है।

Debajyoti Datta, Trishala Neeraj, Bibek Paudel, Vyom Sharma, Subhabrata Mukherjee2026-02-10
💬 NLP

WorldTravel: A Realistic Multimodal Travel-Planning Benchmark with Tightly Coupled Constraints

यह शोध पत्र **WorldTravel** को प्रस्तुत करता है, जो एक नया मल्टीमॉडल बेंचमार्क है और इसमें जटिल, वास्तविक दुनिया के यात्रा परिदृश्य शामिल हैं जिन्हें टेक्स्ट और विजुअल वेब वातावरण के माध्यम से घनिष्ठ रूप से जुड़े टेम्पोरल (समय संबंधी) और लॉजिकल (तार्किक) बाधाओं को नेविगेट करने में वर्तमान फ्रंटियर मॉडल्स के महत्वपूर्ण प्रदर्शन अंतराल को उजागर करने के लिए डिज़ाइन किया गया है।

Zexuan Wang, Chenghao Yang, Yingqi Que, Zhenzhu Yang, Huaqing Yuan, Yiwen Wang, Zhengxuan Jiang, Shengjie Fang, Zhenhe W (…)2026-02-10