💬 NLP

AgentSPEX: An Agent SPecification and EXecution Language

यह शोधपत्र AgentSPEX को प्रस्तुत करता है, जो एक डोमेन-विशिष्ट भाषा और निष्पादन ढांचा (execution framework) है जो स्पष्ट कंट्रोल फ्लो, मॉड्यूलर संरचना और स्टेट मैनेजमेंट के साथ LLM-एजेंट वर्कफ़्लो को निर्दिष्ट करने में सक्षम बनाता है, जो मौजूदा पायथन-युग्मित ऑर्केस्ट्रेशन टूल्स के अधिक व्याख्या योग्य और रखरखाव योग्य विकल्प के रूप में कार्य करता है।

Pengcheng Wang, Jerry Huang, Jiarui Yao, Rui Pan, Peizhi Niu, Yaowenqi Liu, Ruida Wang, Renhao Lu, Yuwei Guo, Tong Zhang2026-04-16
💬 NLP

Peer-Predictive Self-Training for Language Model Reasoning

यह शोध पत्र पीयर-प्रेडिक्टिव सेल्फ-ट्रेनिंग (PST) का परिचय देता है, जो एक लेबल-मुक्त ढांचा है जहाँ कई भाषा मॉडल क्रॉस-मॉडल एग्रीगेटेड रिस्पॉन्स को पॉइंटवाइज म्यूचुअल इंफॉर्मेशन द्वारा स्केल किए गए आंतरिक प्रशिक्षण संकेतों के रूप में उपयोग करके अपनी तर्क क्षमताओं में सहयोगात्मक रूप से सुधार करते हैं, जिससे बाहरी पर्यवेक्षण के बिना गणितीय बेंचमार्क पर महत्वपूर्ण सटीकता लाभ प्राप्त होता है।

Shi Feng, Hanlin Zhang, Fan Nie, Sham Kakade, Yiling Chen2026-04-16
💬 NLP

From Prediction to Justification: Aligning Sentiment Reasoning with Human Rationale via Reinforcement Learning

यह शोध पत्र ABSA-R1 प्रस्तुत करता है, जो एक लार्ज लैंग्वेज मॉडल फ्रेमवर्क है जो एक "अनुमान लगाने से पहले तर्क देने" (reason-before-predict) की प्रक्रिया को लागू करने के लिए सुदृढीकरण शिक्षण (reinforcement learning) और एक संज्ञानात्मक-संरेखित पुरस्कार तंत्र (cognition-aligned reward mechanism) का उपयोग करता है, जिससे मानव-समान औचित्य उत्पन्न होते हैं जो पहलू-आधारित भावना विश्लेषण (Aspect-based Sentiment Analysis) की व्याख्यात्मकता और सटीकता दोनों में सुधार करते हैं।

Shihao Zhang, Ziwei Wang, Jie Zhou, Yulan Wu, Qin Chen, Zhikai Lei, Liyang Yu, Liang Dou, Liang He2026-04-16
💬 NLP

CANVAS: Continuity-Aware Narratives via Visual Agentic Storyboarding

यह शोधपत्र CANVAS को प्रस्तुत करता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो लंबी अवधि की दृश्य कहानी कहने (लॉन्ग-फॉर्म विजुअल स्टोरीटेलिंग) में निरंतरता की चुनौतियों को दूर करने के लिए चरित्र निरंतरता, निरंतर पृष्ठभूमि एंकर्स और स्थान-जागरूक दृश्य योजना के माध्यम से दृश्य निरंतरता की स्पष्ट रूप से योजना बनाता है, जो कई बेंचमार्क पर मौजूदा बेसलाइनों की तुलना में महत्वपूर्ण सुधार प्रदर्शित करता है।

Ishani Mondal, Yiwen Song, Mihir Parmar, Palash Goyal, Jordan Boyd-Graber, Tomas Pfister, Yale Song2026-04-16
💬 NLP

Functional Emotions or Situational Contexts? A Discriminating Test from the Mythos Preview System Card

यह नोट दो प्रतिस्पर्धी परिकल्पनाओं की पहचान करता है जो क्लॉड मिथोस प्रिव्यू (Claude Mythos Preview) सिस्टम कार्ड के गुणात्मक रूप से सुसंगत हैं — कि इमोशन वेक्टर्स (emotion vectors) कार्यात्मक भावनाओं को ट्रैक करते हैं जो कार्यहीन व्यवहार को कारणवत रूप से संचालित करती हैं, या वे एक समृद्ध स्थितिजन्य-संदर्भ संरचना का एक प्रक्षेपण हैं — और उस क्रॉस-रेफरेंस परीक्षण को निर्दिष्ट करता है जो उनके बीच अंतर करेगा, जिसके सीधे परिणाम इस बात पर होंगे कि क्या भावना-आधारित निगरानी विश्वसनीय रूप से खतरनाक मॉडल व्यवहार का पता लगा सकती है।

Hiranya V. Peiris2026-04-16✓ Author reviewed
💬 NLP

Using reasoning LLMs to extract SDOH events from clinical notes

यह अध्ययन प्रदर्शित करता है कि तर्क करने में सक्षम लार्ज लैंग्वेज मॉडल्स (LLMs), जो प्रॉम्प्ट इंजीनियरिंग, फ्यू-शॉट लर्निंग, सेल्फ-कंसिस्टेंसी और पोस्ट-प्रोसेसिंग के चार-मॉड्यूल ढांचे द्वारा निर्देशित होते हैं, प्रतिस्पर्धी प्रदर्शन और कार्यान्वयन सरलता के साथ असंरचित क्लिनिकल नोट्स से संरचित सोशल डिटरमिनेंट्स ऑफ हेल्थ (SDOH) घटनाओं को प्रभावी ढंग से निकाल सकते हैं।

Ertan Doganl, Kunyu Yu, Yifan Peng2026-04-16
💬 NLP

Synthesizing Instruction-Tuning Datasets with Contrastive Decoding

यह शोध पत्र CoDIT को प्रस्तुत करता है, जो निर्देश-अनुसरण क्षमताओं को पूर्व-प्रशिक्षित ज्ञान से अलग करने के लिए कंट्रास्टिव डिकोडिंग (contrastive decoding) लागू करके निर्देश-ट्यूनिंग डेटासेट को संश्लेषित करने की एक विधि है, जिसके परिणामस्वरूप ऐसे मॉडल प्राप्त होते हैं जो मौजूदा डेटासेट पर प्रशिक्षित मॉडलों से बेहतर प्रदर्शन करते हैं और विभिन्न आर्किटेक्चरों में चैट क्षमताओं के हस्तांतरण को सक्षम बनाते हैं।

Tatsuya Ichinose, Youmi Ma, Masanari Oi, Ryuto Koike, Naoaki Okazaki2026-04-16
💬 NLP

Debate to Align: Reliable Entity Alignment through Two-Stage Multi-Agent Debate

यह शोध पत्र AgentEA का प्रस्ताव करता है, जो एक विश्वसनीय एंटिटी अलाइनमेंट फ्रेमवर्क है जो एंटिटी रिप्रेजेंटेशन प्रेफरेंस ऑप्टिमाइजेशन और एक नवीन टू-स्टेज मल्टी-एजेंट डिबेट मैकेनिज्म के माध्यम से निर्णय लेने की क्षमता को बढ़ाता है, तथा विविध नॉलेज ग्राफ सेटिंग्स में उत्कृष्ट प्रदर्शन प्रदर्शित करता है।

Cunda Wang, Ziying Ma, Po Hu, Weihua Wang, Feilong Bao2026-04-16
💬 NLP

YOCO++: Enhancing YOCO with KV Residual Connections for Efficient LLM Inference

यह शोध पत्र YOCO++ प्रस्तुत करता है, जो एक उन्नत क्रॉस-लेयर KV संपीड़न विधि है जो मूल YOCO दृष्टिकोण के प्रदर्शन को बेहतर बनाने के लिए भारित अवशिष्ट कनेक्शनों (weighted residual connections) को शामिल करती है, जिससे प्रशिक्षण या अनुमान गति से समझौता किए बिना 50% KV कैश संपीड़न दर पर मानक ट्रांसफॉर्मर से बेहतर प्रदर्शन करते हुए अत्याधुनिक दक्षता प्राप्त होती है।

You Wu, Ziheng Chen, Yizhen Zhang, Haoyi Wu, Chengting Yu, Yuchi Xu, Wenbo Su, Bo Zheng, Kewei Tu2026-04-16
💬 NLP

BenGER: A Collaborative Web Platform for End-to-End Benchmarking of German Legal Tasks

यह शोध पत्र BenGER को प्रस्तुत करता है, जो एक ओपन-सोर्स वेब प्लेटफॉर्म है जिसे सहयोगी एनोटेशन (collaborative annotation), कॉन्फ़िगर करने योग्य LLM निष्पादन (configurable LLM execution) और बहुआयामी मूल्यांकन मेट्रिक्स (multi-faceted evaluation metrics) को एक ही पुनरुत्पादक वातावरण (reproducible environment) में एकीकृत करके जर्मन कानूनी कार्यों के एंड-टू-एंड बेंचमार्किंग को सुव्यवस्थित और एकीकृत करने के लिए डिज़ाइन किया गया है।

Sebastian Nagl, Matthias Grabmair2026-04-16