💬 NLP

Generative AI and the future of scientometrics: current topics and future questions

यह शोध पत्र टेक्स्ट के अर्थगत (semantic) और व्यावहारिक (pragmatic) आयामों के बीच अंतर करने वाला एक वैचारिक ढांचा प्रस्तावित करता है ताकि साइंटोमेट्रिक्स में जनरेटिव एआई के सिद्धांतपूर्ण, व्याख्यात्मक एकीकरण का मार्गदर्शन किया जा सके, साथ ही विज्ञान को मापने के लिए उपयोग किए जाने वाले मौलिक पाठ्य गुणों को बदलने की इसकी क्षमता के प्रति चेतावनी भी दी जा सके।

Benedetto Lepori, Jens Peter Andersen, Karsten Donnay2026-06-16
💬 NLP

Dual-branch Prompting for Multimodal Machine Translation

यह शोध पत्र D2P-MMT का प्रस्ताव करता है, जो एक डिफ्यूजन-आधारित ड्यूल-ब्रांच प्रॉम्प्टिंग फ्रेमवर्क है जो विज़ुअल नॉइज़ को फ़िल्टर करने के लिए पुनर्रचित छवियों का उपयोग करके और प्रशिक्षण-अनुमान अंतराल को पाटने के लिए एक वितरण संरेखण हानि (डिस्ट्रीब्यूशनल एलाइनमेंट लॉस) का उपयोग करके मल्टीमॉडल मशीन ट्रांसलेशन की मजबूती को बढ़ाता है, जिससे Multi30K डेटासेट पर बेहतर प्रदर्शन प्राप्त होता है।

Jie Wang, Zhendong Yang, Liansong Zong, Xiaobo Zhang, Dexian Wang, Ji Zhang2026-06-16
💬 NLP

MedSynth: Realistic, Synthetic Medical Dialogue-Note Pairs

मेडसिंथ (MedSynth) एक नवीन, बड़े पैमाने का सिंथेटिक डेटासेट है जिसमें 2,000 से अधिक ICD-10 कोड्स को कवर करने वाले 10,000 से अधिक गोपनीयता-अनुपालक चिकित्सा संवाद-नोट युग्म शामिल हैं, जिसे विविध, ओपन-एक्सेस प्रशिक्षण डेटा की कमी को दूर करके स्वचालित चिकित्सा दस्तावेज़ीकरण प्रणालियों के प्रदर्शन को महत्वपूर्ण रूप से बढ़ाने के लिए डिज़ाइन किया गया है।

Ahmad Rezaie Mianroodi, Amirali Rezaie, Niko Grisel Todorov, Nadine A. Friedrich, Maria P Mogollon, Alexander Hernandez- (…)2026-06-16
💬 NLP

Integrating Feedback Loss from Bi-modal Sarcasm Detector for Sarcastic Speech Synthesis

यह शोध पत्र एक नवीन व्यंग्यात्मक भाषण संश्लेषण (सार्केस्टिक स्पीच सिंथेसिस) ढांचे का प्रस्ताव करता है जो डेटा की कमी को दूर करने और उत्पन्न व्यंग्यात्मक भाषण की स्वाभाविकता एवं अभिव्यक्ति में सुधार करने के लिए एक द्वि-चरणीय ट्रांसफर लर्निंग रणनीति को द्वि-आयामी (बाय-मोडल) व्यंग्य डिटेक्टर से प्राप्त फीडबैक लॉस के साथ जोड़ता है।

Zhu Li, Yuqing Zhang, Xiyuan Gao, Devraj Raghuvanshi, Nagendra Kumar, Shekhar Nayak, Matt Coler2026-06-16
💬 NLP

JE-IRT: A Geometric Lens on LLM Abilities through Joint Embedding Item Response Theory

JE-IRT एक ज्यामितीय ढांचे (geometric framework) को प्रस्तुत करता है जो LLMs और प्रश्नों को एक साझा स्थान में समाहित करता है जहाँ प्रश्न की दिशा अर्थविज्ञान (semantics) को और परिमाण (norm) कठिनाई को कूटबद्ध करती है, जो वैश्विक रैंकिंग के स्थान पर एक बहुआयामी दृष्टिकोण प्रदान करता है जो मॉडल विशेषज्ञता को प्रकट करता है, आउट-ऑफ-डिस्ट्रीब्यूशन व्यवहार की व्याख्या करता है, और मानव-परिभाषित श्रेणियों से परे अंतर्निहित क्षमता संरचनाओं को उजागर करता है।

Louie Hong Yao, Nicholas Jarvis, Tiffany Zhan, Saptarshi Ghosh, Linfeng Liu, Tianyu Jiang2026-06-16
💬 NLP

A Survey on Agentic Security: Applications, Threats and Defenses

यह शोध पत्र एजेंटिक सुरक्षा (agentic security) का पहला समग्र सर्वेक्षण प्रस्तुत करता है, जो 260 से अधिक शोध पत्रों का एक व्यापक वर्गीकरण प्रदान करता है जो LLM-आधारित एजेंट अनुप्रयोगों, उनके अंतर्निहित खतरों और संबंधित सुरक्षा उपायों के बीच के अंतर्संबंधों को एकीकृत करता है ताकि यह प्रदर्शित किया जा सके कि इन संरचनात्मक रूप से नाजुक प्रणालियों को सुरक्षित करने के लिए एकल-परत सुधारों के बजाय पूर्ण जीवनचक्र रणनीतियों की आवश्यकता होती है।

Asif Shahriar, Md Nafiu Rahman, Sadif Ahmed, Farig Sadeque, Md Rizwan Parvez2026-06-16
⚡ electrical engineering

Modeling Sarcastic Speech: Semantic and Prosodic Cues in a Speech Synthesis Framework

यह शोधपत्र एक ऐसा कम्प्यूटेशनल ढांचा प्रस्तावित करता है जो व्यंग्यात्मक भाषण के मॉडलिंग और संश्लेषण के लिए एक व्यंग्यात्मक भाषण डेटाबेस से प्रोसोडिक उदाहरणों (prosodic exemplars) को LLaMA 3-व्युत्पन्न सिमेंटिक संकेतों (semantic cues) के साथ एकीकृत करता है, यह प्रदर्शित करते हुए कि इन तौर-तरीकों (modalities) को संयोजित करने से व्यंग्य की वस्तुनिष्ठ पहचान मेट्रिक्स और व्यक्तिपरक धारणा दोनों में महत्वपूर्ण सुधार होता है।

Zhu Li, Yuqing Zhang, Xiyuan Gao, Shekhar Nayak, Matt Coler2026-06-16
🤖 AI

A Unified Definition of Hallucination: It's The World Model, Stupid!

यह शोध पत्र मतिभ्रम (hallucination) की एक एकीकृत परिभाषा प्रस्तावित करता है जो उपयोगकर्ता के लिए दृश्यमान आंतरिक विश्व मॉडलिंग की अशुद्धि है, और यह तर्क देता है कि यह ढांचा पूर्व परिभाषाओं को समाहित करता है, संदर्भ जगतों को निर्दिष्ट करके मूल्यांकन मानकों को स्पष्ट करता है, और बेहतर बेंचमार्किंग एवं शमन रणनीतियों को सुगम बनाने के लिए मतिभ्रम को अन्य त्रुटि प्रकारों से अलग करता है।

Emmy Liu, Varun Gangal, Chelsea Zou, Michael Yu, Xiaoqi Huang, Alex Chang, Zhuofu Tao, Karan Singh, Sachin Kumar, Steven (…)2026-06-16
🤖 AI

When RAG Hurts: Diagnosing and Mitigating Attention Distraction in Retrieval-Augmented LVLMs

यह शोध पत्र "अटेंशन डिस्ट्रैक्शन" (Attention Distraction) को रिट्रीवल-ऑगमेंटेड लार्ज विजन-लैंग्वेज मॉडल्स में एक नवीन विफलता मोड के रूप में पहचानता है जहाँ प्रासंगिक रिट्रीव्ड टेक्स्ट विजुअल अटेंशन को दबा देता है, और MAD-RAG का प्रस्ताव करता है, जो एक ट्रेनिंग-फ्री विधि है जो विजुअल ग्राउंडिंग को कॉन्टेक्स्ट इंटीग्रेशन से अलग करके इस समस्या को महत्वपूर्ण रूप से कम करती है।

Beidi Zhao, Wenlong Deng, Xinting Liao, Yushu Li, Nazim Shaikh, Yao Nie, Xiaoxiao Li2026-06-16
💬 NLP

A Systematic Evaluation of Large Language Models for PTSD Severity Estimation: The Role of Contextual Knowledge and Modeling Strategies

यह अध्ययन 1,437 व्यक्तियों के एक नैदानिक डेटासेट पर 11 लार्ज लैंग्वेज मॉडल्स का व्यवस्थित रूप से मूल्यांकन करता है, जो यह प्रदर्शित करता है कि विस्तृत प्रासंगिक ज्ञान प्रदान करना और विशिष्ट मॉडलिंग रणनीतियों—जैसे कि बढ़ी हुई तर्क क्षमता और एन्सेम्बल विधियों—का उपयोग करना, पीटीएसडी (PTSD) गंभीरता के आकलन में एलएलएम (LLM) आधारित सटीकता और नैदानिक उपयोगिता को महत्वपूर्ण रूप से बढ़ाता है, जो अक्सर मानव रेटर सहमति से भी बेहतर होता है।

Panagiotis Kaliosis, Adithya V Ganesan, Oscar N. E. Kjell, Whitney Ringwald, Scott Feltman, Melissa A. Carr, Dimitris Sa (…)2026-06-16