💬 NLP

DiLaDiff: Distilled Latent-Augmented Diffusion for Language Modeling

DiLaDiff एक सिमेंटिक लेटेंट स्पेस, एक लेटेंट डिफ्यूजन प्रायर और कंसिस्टेंसी डिस्टिलेशन का उपयोग करने वाले एक तीन-चरणीय ढांचे को पेश करके डिफ्यूजन लैंग्वेज मॉडल्स में सैंपलिंग गुणवत्ता और थ्रूपुट के बीच के ट्रेड-ऑफ को संबोधित करता है ताकि उच्च-गुणवत्ता वाली, कुछ-चरणों वाली जनरेशन प्राप्त की जा सके जो मास्क डिफ्यूजन बेसलाइन्स से काफी बेहतर प्रदर्शन करती है।

Jean-Marie Lemercier, Tomas Geffner, Karsten Kreis, Morteza Mardani, Arash Vahdat, Ante Jukić2026-05-25
💬 NLP

How Human-Like Are Large Language Models? A Register-Aware Linguistic Evaluation Framework

यह शोध पत्र मैक्सिमम मीन डिसक्रीपेंसी और बाइबर के लेक्सिको-ग्रामैटिकल फीचर्स का उपयोग करते हुए एक रजिस्टर-जागरूक मूल्यांकन ढांचे को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि जबकि लार्ज लैंग्वेज मॉडल्स लगातार मानवीय भाषाई पैटर्न से विचलित होते हैं, उनकी मानव-समानता की डिग्री संचारत्मक रजिस्टर के अनुसार भिन्न होती है और मॉडल के आकार द्वारा निर्धारित नहीं होती है।

Björn Nieth (Department Artificial Intelligence in Biomedical Engineering, Chair of AI-supported Therapy Decisions LMU M (…)2026-05-25
💬 NLP

A graph-based analysis of semantic types and coercion in contextualized word embeddings

यह शोध पत्र BERT और सेंस-एन्हांस्ड एम्बेडिंग्स पर नेबर टाइप प्रोबेबिलिटी और एंट्रॉपी मेट्रिक्स का उपयोग करते हुए एक ग्राफ-आधारित विश्लेषण प्रस्तावित करता है ताकि यह प्रदर्शित किया जा सके कि सिमेंटिक टाइप सूचना और कोअर्सन (coercion) परिघटनाएं सेंस-एन्हांस्ड मॉडल्स में बेहतर तरीके से कैप्चर की जाती हैं, जिससे मैचिंग और मिसमैचिंग नाउन-कॉन्टेक्स्ट पेयर्स के बीच अंतर करना सक्षम होता है।

Long Chen, Deniz Ekin Yavas2026-05-25
💬 NLP

NLG Evaluation: Past, Present, Future

यह शोध पत्र 1990 में अपने भाषाविज्ञान-केंद्रित उद्गम से लेकर वर्तमान मशीन लर्निंग-संचालित प्रयोगात्मक प्रतिमान तक नेचुरल लैंग्वेज जनरेशन (NLG) मूल्यांकन के विकास का पता लगाता है, और यह भविष्यवाणी करता है कि जैसे-जैसे NLG तकनीक सर्वव्यापी होती जा रही है, भविष्य का आकलन प्रभाव, गुणात्मक और सुरक्षा मेट्रिक्स को प्राथमिकता देता जाएगा।

Ehud Reiter2026-05-25
💬 NLP

Hierarchical Concept Geometry in Language Models Emerges from Word Co-occurrence

यह शोध पत्र एक वितरण संबंधी सिद्धांत (distributional theory) प्रस्तावित और मान्य करता है जो यह दर्शाता है कि भाषा मॉडलों में अवधारणाओं की पदानुक्रमित ज्यामितीय संरचना विशेष कार्यात्मक तंत्रों की आवश्यकता के बजाय शब्द सह-उपस्थिति सांख्यिकी के स्पेक्ट्रल गुणों से स्वाभाविक रूप से उभरती है।

Andres Nava, Matthieu Wyart2026-05-25
💬 NLP

Decomposing Queries into Tool Calls for Long-Video Keyframe Retrieval

यह शोध पत्र ToolMerge को प्रस्तुत करता है, जो एक नवीन कीफ्रेम रिट्रीवल विधि है जो क्वेरीज़ को विशिष्ट टूल कॉल्स में विभाजित करने और उनके परिणामों को बूलियन ऑपरेटर्स के माध्यम से मर्ज करने के लिए एक LLM का लाभ उठाती है, जो नए प्रस्तावित Molmo-2 Moments बेंचमार्क पर प्रतिस्पर्धी प्रदर्शन प्रदर्शित करती है।

Michal Shlapentokh-Rothman, Prachi Garg, Yu-Xiong Wang, Derek Hoiem2026-05-25
💬 NLP

Strong Teacher Not Needed? On Distillation in LLM Pretraining

यह शोध पत्र इस पारंपरिक धारणा को चुनौती देता है कि प्रभावी ज्ञान आसवन (नॉलेज डिस्टिलेशन) के लिए लार्ज लैंग्वेज मॉडल प्रीट्रेनिंग हेतु एक सशक्त शिक्षक की आवश्यकता होती है, यह प्रदर्शित करते हुए कि यदि लॉस फंक्शन को उचित रूप से मिश्रित किया जाए तो छोटे या कम प्रशिक्षित शिक्षक भी बड़े छात्रों में सुधार कर सकते हैं, जबकि अधिक शक्तिशाली शिक्षक हमेशा बेहतर परिणाम नहीं देते हैं।

Taiming Lu, Zhuang Liu2026-05-25
💬 NLP

ETCHR: Editing To Clarify and Harness Reasoning

यह शोध पत्र ETCHR को प्रस्तुत करता है, जो एक विच्छेदित (decoupled), तर्क-सचेत (reasoning-aware) इमेज एडिटिंग फ्रेमवर्क है जो दो-चरणीय प्रशिक्षण रेसिपी के माध्यम से अमूर्त प्रश्नों और दृश्य रूपांतरणों के बीच के अंतर को पाटता है, जिससे कई कार्य परिवारों में विविध मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की दृश्य तर्क क्षमताओं को महत्वपूर्ण रूप से बढ़ाता है।

Beichen Zhang, Yuhong Liu, Jinsong Li, Yuhang Zang, Jiaqi Wang, Dahua Lin2026-05-25
💬 NLP

Internal narratives parameterise affective states

लार्ज-लैंग्वेज-मॉडल रिप्रेजेंटेशन का उपयोग करने वाले दो बड़े पैमाने के अध्ययनों के माध्यम से, यह शोध प्रदर्शित करता है कि आंतरिक आख्यानों की संरचना और गतिशीलता न केवल अवसाद की गंभीरता की भविष्यवाणी करती है बल्कि भावनात्मक अवस्थाओं को कारणवश प्रभावित भी करती है, जो यह सुझाव देता है कि प्रभाव (affect) एक कम्प्यूटेशनल अवस्था के रूप में कार्य करता है जो आख्यान निर्माण को सीमित करता है और संदर्भ को एकीकृत करता है।

Jakub Onysk, Quentin J. M. Huys2026-05-22
💬 NLP

Evaluating Clinical Competencies of Large Language Models with a General Practice Benchmark

यह शोध पत्र सामान्य अभ्यास (जनरल प्रैक्टिस) के लिए एक नवीन क्षमता-आधारित बेंचमार्क, GPBench को प्रस्तुत करता है, जो दस अत्याधुनिक लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करता है और यह निष्कर्ष निकालता है कि वर्तमान मॉडल अभी स्वायत्त नैदानिक तैनाती के लिए उपयुक्त नहीं हैं, जिसके लिए निरंतर मानवीय पर्यवेक्षण और आगे के अनुकूलन की आवश्यकता है।

Zheqing Li, Yiying Yang, Jiping Lang, Wenhao Jiang, Junrong Chen, Yuhang Zhao, Shuang Li, Dingqian Wang, Zhu Lin, Xuanna (…)2026-05-22