💬 NLP

SKG-Eval: Stateful Evaluation of Multi-Turn Dialogue via Incremental Semantic Knowledge Graphs

SKG-Eval एक नवीन, व्याख्यात्मक ढांचा है जो संरचित अवस्था ट्रैकिंग के माध्यम से लंबी दूरी की विसंगतियों और विरोधाभासों का पता लगाने के लिए एक सिमेंटिक नॉलेज ग्राफ को वृद्धिशील रूप से निर्मित करके मल्टी-टर्न संवाद प्रणालियों का मूल्यांकन करता है, जिससे मौजूदा फ्लैट या टर्न-पृथक मेट्रिक्स की तुलना में मानव निर्णयों के साथ उच्च सहसंबंध प्राप्त होता है।

Avijit Shil, Suman Samui2026-05-19✓ Author reviewed
💬 NLP

A Scalable Tool for Measuring Manner and Result Verbs in Developmental Language Research

यह शोध पत्र एक स्केलेबल कम्प्यूटेशनल टूल प्रस्तुत करता है जो बड़े पैमाने पर विकासात्मक भाषा अनुसंधान को समर्थन देने के लिए 'मैनर' (manner) और 'रिजल्ट' (result) क्रियाओं के बीच अंतर करने में 89.6% तक सटीकता प्राप्त करते हुए, एक RoBERTa-आधारित क्लासिफायर के लिए प्रशिक्षण डेटा उत्पन्न करने हेतु लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है।

Divyesh Pratap Singh, Dakshesh Gusain, Federica Bulgarelli, Alison Eisel Hendricks, John Beavers, Nathan M. Beers, Ifeom (…)2026-05-19
🧬 biology

EmoMind: Decoding Affective Captions from Human Brain fMRI

EmoMind एक नवीन एंड-टू-एंड पाइपलाइन है जो अर्थपूर्ण रूप से आधारित दृश्य विवरणों को निरंतर 34-आयामी भावना वेक्टर्स के साथ संयोजित करके fMRI संकेतों से सीधे भावनात्मक कैप्शन डिकोड करती है, जो व्यक्तिगत, व्यक्ति-विशिष्ट भावनात्मक आख्यानों को उत्पन्न करने में डिस्क्रीट लेबल-आधारित बेसलाइन्स की तुलना में काफी बेहतर प्रदर्शन करती है।

Bilal A. Mohammed, Lin Gu, Ruogo Fang2026-05-19
💬 NLP

Exploring Lightweight Large Language Models for Court View Generation

यह शोध पत्र क्रिमिनल कोर्ट व्यू जनरेशन और आरोप पूर्वानुमान के लिए हल्के वजन वाले बड़े भाषा मॉडलों (2B पैरामीटर्स से कम) की क्षमताओं की व्यवस्थित रूप से जांच करता है, जो मॉडल आर्किटेक्चर, आकार और कार्य अंतर्निर्भरताओं के बीच के समझौतों का विश्लेषण करने के लिए CVGEvalKit मूल्यांकन ढांचे को पेश करता है और न्यायिक एआई में इन मॉडलों की क्षमता को प्रदर्शित करता है।

Zhitian Hou, Tianyong Hao, Nanli Zeng, Zhixiong Chao, Kun Zeng2026-05-19
🤖 machine learning

TIER: Trajectory-Invariant Execution Rewards for Multi-Step Tool Composition

यह शोध पत्र TIER का प्रस्ताव करता है, जो एक ऐसा रिवॉर्ड फ्रेमवर्क है जो फंक्शन स्कीमा और रनटाइम निष्पादन का लाभ उठाकर मल्टी-स्टेप टूल उपयोग के लिए सघन, ट्राजेक्टरी-इनवेरिएंट सुपरविजन प्रदान करता है, जिससे लार्ज लैंग्वेज मॉडल्स को उन जटिल कंपोजिशनल कार्यों पर उच्च सटीकता प्राप्त करने में सक्षम बनाया जा सके जहाँ मौजूदा ट्राजेक्टरी-आधारित विधियाँ विफल हो जाती हैं।

Anay Kulkarni, ChiaEn Lu, Dheeraj Mekala, Jayanth Srinivasa, Gaowen Liu, Jingbo Shang2026-05-19
🤖 machine learning

FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation

FIM-LoRA एक हल्का, प्रशिक्षण-मुक्त तरीका है जो प्री-फाइन-ट्यूनिंग ग्रेडिएंट वेरिएंस अनुमानों के आधार पर परतों के बीच रैंक बजट को पुनर्वितरित करके LoRA प्रदर्शन को अनुकूलित करता है, जिससे मानक यूनिफॉर्म-रैंक LoRA के तुलनीय परिणाम प्राप्त होते हैं और साथ ही परत-विशिष्ट कार्य सूचनात्मकता में व्याख्या योग्य अंतर्दृष्टि प्रदान की जाती है।

Ramakrishnan Sathyavageeswaran2026-05-19
🤖 machine learning

Decoupling KL and Trajectories: A Unified Perspective for SFT, DAgger, Offline RL, and OPD in LLM Distillation

यह शोध पत्र एक एकीकृत ढांचे का प्रस्ताव करता है जो LLM डिस्टिलेशन में पारंपरिक रूप से जुड़े हुए प्रिफिक्स स्रोत (prefix source) और KL डाइवर्जेंस दिशा के विकल्पों को अलग करता है, जो चार विशिष्ट उद्देश्यों को प्रकट करता है और तर्क संबंधी कार्यों (reasoning tasks) में सटीकता, विविधता और दक्षता के बीच संतुलन को अनुकूलित करने के लिए KL मिक्सिंग और एंट्रॉपी-गेटेड करिकुलम जैसी व्यावहारिक तकनीकों को पेश करता है।

Anhao Zhao, Haoran Xin, Yingqi Fan, Junlong Tong, Wenjie Li, Xiaoyu Shen2026-05-19
💬 NLP

Constrained Code Generation with Discrete Diffusion

यह शोध पत्र 'कंस्ट्रेंड डिफ्यूजन फॉर कोड' (CDC) को प्रस्तुत करता है, जो एक ट्रेनिंग-फ्री न्यूरोसिम्बोलिक फ्रेमवर्क है जो कोड जनरेशन को न्यूनतम सुधारात्मक गणना के साथ कार्यात्मक रूप से सही, सुरक्षित और सिंटैक्टिक रूप से वैध प्रोग्रामों की ओर निर्देशित करने के लिए डिस्क्रीट डिफ्यूजन डिनोइजिंग प्रक्रिया में सीधे बाधा संतुप्ति (constraint satisfaction) को एकीकृत करता है।

Lize Shao, Michael Cardei, Zichen Xie, Ferdinando Fioretto, Wenxi Wang2026-05-19
💬 NLP

CompactAttention: Accelerating Chunked Prefill with Block-Union KV Selection

कॉम्पैक्टअटेंशन (CompactAttention) एक ब्लॉक-यूनियन केवी सिलेक्शन (Block-Union KV Selection) तंत्र को पेश करके लॉन्ग-कॉन्टेक्स्ट लार्ज लैंग्वेज मॉडल्स में चंक्ड प्रीफिल (chunked prefill) को तेज़ करता है, जो 2D ब्लॉक-स्पार्स मास्क को कुशल, GQA-जागरूक प्रति-ग्रुप केवी ब्लॉक टेबल्स (per-group KV block tables) में परिवर्तित करता है, जिससे बिना किसी स्पष्ट कॉम्पैक्शन के इन-प्लेस मेमोरी एक्सेस सक्षम होता है और साथ ही डेंस सटीकता (near-dense accuracy) बनाए रखते हुए 2.72x तक की गति वृद्धि प्राप्त होती है।

Jiwon Song, Dongwon Jo, Beomseok Kang, Jae-Joon Kim2026-05-19
💬 NLP

RTI-Bench: A Structured Dataset for Indian Right-to-Information Decision Analysis

यह शोध पत्र RTI-Bench प्रस्तुत करता है, जो भारतीय सूचना के अधिकार (Right-to-Information) के निर्णयों का पहला सार्वजनिक रूप से उपलब्ध संरचित डेटासेट है, जिसमें परिणाम लेबल, छूट उद्धरण और तर्क घटक शामिल हैं, जिसे प्रशासनिक अपील के परिणामों के विश्लेषण और भविष्यवाणी को सक्षम करने के लिए डिज़ाइन किया गया है।

Joy Bose2026-05-19