💬 NLP

Hybrid Policy Distillation for LLMs

यह शोध पत्र हाइब्रिड पॉलिसी डिस्टिलेशन (HPD) को प्रस्तुत करता है, जो एक एकीकृत नॉलेज डिस्टिलेशन फ्रेमवर्क है जो विविध कार्यों में लार्ज लैंग्वेज मॉडल्स को कंप्रेस करने की स्थिरता, दक्षता और प्रदर्शन को बढ़ाने के लिए ऑफ-पॉलिसी और एप्रोक्सिमेट ऑन-पॉलिसी डेटा के मिश्रण के साथ फॉरवर्ड और रिवर्स KL डाइवर्जेंस को एकीकृत करता है।

Wenhong Zhu, Ruobing Xie, Rui Wang, Pengfei Liu2026-04-23
💬 NLP

ActuBench: A Multi-Agent LLM Pipeline for Generation and Evaluation of Actuarial Reasoning Tasks

यह शोध पत्र ActuBench को प्रस्तुत करता है, जो एक मल्टी-एजेंट LLM पाइपलाइन है जो IAA पाठ्यक्रम के अनुरूप उन्नत बीमांकिक (एक्चुअरियल) तर्क कार्यों के सृजन और मूल्यांकन को स्वचालित करता है, यह प्रदर्शित करते हुए कि स्वतंत्र सत्यापन आइटम की गुणवत्ता में महत्वपूर्ण सुधार करता है और यह भी प्रकट करता है कि स्थानीय रूप से होस्ट किए गए ओपन-वेट्स मॉडल बेहतर लागत-प्रदर्शन व्यापार-संबंधों (कॉस्ट-परफॉर्मेंस ट्रेड-ऑफ) की पेशकश करते हैं और शीर्ष-स्तरीय मॉडल क्षमताओं को सटीक रूप से विभेदित करने के लिए ओपन-एंडेड मूल्यांकन आवश्यक है।

Jan-Philipp Schmidt2026-04-23
💬 NLP

Surrogate modeling for interpreting black-box LLMs in medical predictions

यह शोध पत्र एक सरोगेट मॉडलिंग फ्रेमवर्क प्रस्तावित करता है जो चिकित्सा भविष्यवाणियों में ब्लैक-बॉक्स लार्ज लैंग्वेज मॉडल्स के अंतर्निहित ज्ञान का अनुमान लगाने और उसका मात्रात्मक रूप से व्याख्या करने के लिए व्यापक प्रॉम्पटिंग का उपयोग करता है, जो सुरक्षित मॉडल परिनियोजन का समर्थन करने के लिए स्थापित चिकित्सा ज्ञान के विरोधाभासों और वैज्ञानिक रूप से खंडित नस्लीय पूर्वाग्रहों की निरंतरता, दोनों को सफलतापूर्वक प्रकट करता है।

Changho Han (Medical Big Data Research Center, Seoul National University Medical Research Center, Seoul National Univers (…)2026-04-23
💬 NLP

Graph2Counsel: Clinically Grounded Synthetic Counseling Dialogue Generation from Client Psychological Graphs

यह शोधपत्र Graph2Counsel प्रस्तुत करता है, जो डेटा की कमी और गोपनीयता संबंधी सीमाओं को दूर करने के लिए संरचित क्लाइंट साइकोलॉजिकल ग्राफ्स (Client Psychological Graphs) का लाभ उठाकर उच्च गुणवत्ता वाले, नैदानिक रूप से आधारित सिंथेटिक काउंसलिंग संवाद उत्पन्न करने वाला एक ढांचा है, जिसके परिणामस्वरूप एक ऐसा डेटासेट प्राप्त होता है जो काउंसलिंग बेंचमार्क पर फाइन-ट्यून किए गए लैंग्वेज मॉडल्स के प्रदर्शन में महत्वपूर्ण सुधार करता है।

Aishik Mandal, Hiba Arnaout, Clarissa W. Ong, Juliet Bockhorst, Kate Sheehan, Rachael Moldow, Tanmoy Chakraborty, Iryna (…)2026-04-23
💬 NLP

Decoding Text Spans for Efficient and Accurate Named-Entity Recognition

यह शोध पत्र SpanDec को पेश करता है, जो एक कुशल स्पैन-आधारित नेम्ड एंटिटी रिकग्निशन (NER) फ्रेमवर्क है जो अंतिम ट्रांसफॉर्मर चरण में स्पैन इंटरैक्शन की गणना करके और असंभवी उम्मीदवारों को छांटने के लिए एक फ़िल्टरिंग तंत्र का उपयोग करके बड़े पैमाने के और ऑन-डिवाइस अनुप्रयोगों के लिए सटीकता-दक्षता व्यापार-बंद (accuracy-efficiency trade-off) में सुधार करता है।

Andrea Maracani, Savas Ozkan, Junyi Zhu, Sinan Mutlu, Mete Ozay2026-04-23
💬 NLP

Not all ANIMALs are equal: metaphorical framing through source domains and semantic frames

यह शोध पत्र एक नवीन कम्प्यूटेशनल ढांचे को प्रस्तुत करता है जो विमर्श में रूपक संबंधी फ्रेमिंग (metaphorical framing) का विश्लेषण करने के लिए स्रोत डोमेन और सिमेंटिक फ्रेम्स को एकीकृत करता है, जिससे यह प्रकट होता है कि राजनीतिक विचारधाराएं जलवायु परिवर्तन और अप्रवासन जैसे मुद्दों की सार्वजनिक समझ को आकार देने के लिए एक ही रूपकों के भीतर विभिन्न सिमेंटिक बारीकियों का व्यवस्थित रूप से उपयोग कैसे करती हैं।

Yulia Otmakhova, Matteo Guida, Lea Frermann2026-04-23
🤖 machine learning

CHASM: Unveiling Covert Advertisements on Chinese Social Media

यह शोध पत्र CHASM को प्रस्तुत करता है, जो चीनी सोशल मीडिया प्लेटफॉर्म रेडनोट (Rednote) से लगभग 5,000 वास्तविक दुनिया के गुप्त विज्ञापनों का एक नया डेटासेट है, ताकि यह प्रदर्शित किया जा सके कि वर्तमान मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स इन भ्रामक पोस्टों का पता लगाने में संघर्ष करते हैं और इस उभरते खतरे के विरुद्ध बेहतर फाइन-ट्यूनिंग और रक्षा तंत्र की आवश्यकता पर प्रकाश डाला जा सके।

Jingyi Zheng, Tianyi Hu, Yule Liu, Zhen Sun, Zongmin Zhang, Zifan Peng, Wenhan Dong, Xinlei He2026-04-23
💬 NLP

Effects of Cross-lingual Evidence in Multilingual Medical Question Answering

यह शोध पत्र उच्च-संसाधन और निम्न-संसाधन भाषाओं में बहुभाषी चिकित्सा प्रश्न-उत्तर की जांच करता है, जो यह प्रकट करता है कि जहाँ बड़े मॉडल और अंग्रेजी वेब-रिट्रीव्ड डेटा उच्च-संसाधन भाषाओं को लाभान्वित करते हैं, वहीं निम्न-संसाधन भाषाएँ अंग्रेजी और लक्षित-भाषा रिट्रीवल को संयोजित करके तुलनीय सटीकता प्राप्त करती हैं, जो अंततः इस धारणा को चुनौती देता है कि बाहरी ज्ञान सार्वभौमिक रूप से प्रदर्शन में सुधार करता है और बहुभाषी चिकित्सा स्रोत कवरेज की सीमाओं को उजागर करता है।

Anar Yeginbergen, Maite Oronoz, Rodrigo Agerri2026-04-23
💬 NLP

Aligning Stuttered-Speech Research with End-User Needs: Scoping Review, Survey, and Guidelines

यह शोध पत्र एक स्कोपिंग रिव्यू और स्टेकहोल्डर सर्वे को जोड़कर वर्तमान हकलाने वाली वाणी (stuttered-speech) के अनुसंधान और अंतिम-उपयोगकर्ता की आवश्यकताओं के बीच के अंतर को संबोधित करता है, ताकि एक शोध वर्गीकरण (taxonomy) और बेहतर दिशा-निर्देश प्रस्तावित किए जा सकें जो तकनीकी विकास को हकलाने वाले लोगों के जीवंत अनुभवों के साथ बेहतर ढंग से संरेखित कर सकें।

Hawau Olamide Toyin, Mutiah Apampa, Toluwani Aremu, Humaid Alblooshi, Ana Rita Valente, Gonçalo Leal, Zhengjun Yue, Zeer (…)2026-04-23
💬 NLP

Enhancing Research Idea Generation through Combinatorial Innovation and Multi-Agent Iterative Search Strategies

यह शोध पत्र दोहरावपूर्ण और उथले LLM-जनित अनुसंधान विचारों की सीमाओं को दूर करने के लिए कॉम्बिनेटोरियल इनोवेशन थ्योरी से प्रेरित एक मल्टी-एजेंट इटरेटिव प्लानिंग सर्च स्ट्रैटेजी प्रस्तावित करता है, जो NLP प्रयोगों के माध्यम से यह प्रदर्शित करता है कि यह फ्रेमवर्क विचार विविधता और नवीनता में महत्वपूर्ण सुधार करता है, तथा शीर्ष स्तरीय मशीन लर्निंग सम्मेलनों में स्वीकृत शोध पत्रों के तुल्य गुणवत्ता प्राप्त करता है।

Shuai Chen, Chengzhi Zhang2026-04-23