💬 NLP

MorphNLI: A Stepwise Approach to Natural Language Inference Using Text Morphing

MorphNLI एक मॉड्यूलर, व्याख्यात्मक प्राकृतिक भाषा अनुमान (natural language inference) ढांचा है जो परमाणु संपादन (atomic edits) के माध्यम से आधारवाक्यों (premises) को परिकल्पनाओं (hypotheses) में क्रमिक रूप से रूपांतरित करता है और विशेष रूप से क्रॉस-डोमेन सेटिंग्स में बेहतर प्रदर्शन प्राप्त करने के लिए मध्यवर्ती एंटेलमेंट लेबल को एकत्रित करता है।

Vlad Andrei Negru, Robert Vacareanu, Camelia Lemnaru, Mihai Surdeanu, Rodica Potolea2026-02-16
💬 NLP

Highlight & Summarize: RAG without the jailbreaks

यह शोध पत्र "हाइलाइट एंड समराइज़" (Highlight & Summarize) को प्रस्तुत करता है, जो एक नवीन रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) आर्किटेक्चर है जो पाइपलाइन को एक हाइलाइटर में विभाजित करके जो उपयोगकर्ता के प्रश्नों से प्रासंगिक अंशों को निकालता है और एक समराइज़र में जो उत्तर उत्पन्न करता है, स्वाभाविक रूप से एलएलएम (LLM) जेलब्रेकिंग को रोकता है, यह सुनिश्चित करते हुए कि जेनेरेटिव मॉडल सीधे तौर पर संभावित रूप से दुर्भावनापूर्ण उपयोगकर्ता इनपुट को प्रोसेस न करे।

Giovanni Cherubin, Andrew Paverd2026-02-16
💬 NLP

Exploring Safety Alignment Evaluation of LLMs in Chinese Mental Health Dialogues via LLM-as-Judge

यह शोध पत्र PsyCrisis-Bench प्रस्तुत करता है, जो एक संदर्भ-मुक्त बेंचमार्क और LLM-as-Judge मूल्यांकन ढांचा है जिसे विशेषज्ञ-निर्धारित तर्क श्रृंखलाओं का उपयोग करके चीनी मानसिक स्वास्थ्य संवादों में बड़े भाषा मॉडलों के सुरक्षा संरेखण का आकलन करने के लिए डिज़ाइन किया गया है, जो मौजूदा विधियों की तुलना में मानव विशेषज्ञों के साथ बेहतर सहमति और उन्नत व्याख्यात्मकता प्रदर्शित करता है।

Yunna Cai, Fan Wang, Haowei Wang, Kun Wang, Kailai Yang, Sophia Ananiadou, Moyan Li, Mingming Fan2026-02-16
💬 NLP

RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation

यह शोध पत्र RPG का परिचय देता है, जो एक संरचित रिपॉजिटरी प्लानिंग ग्राफ (Repository Planning Graph) है जो अस्पष्ट प्राकृतिक भाषा नियोजन को स्पष्ट ब्लूप्रिंट से प्रतिस्थापित करता है, जिससे ZeroRepo फ्रेमवर्क मौजूदा बेसलाइनों की तुलना में बेहतर टेस्ट सटीकता के साथ काफी बड़े, अधिक सुसंगत और उच्च गुणवत्ता वाले सॉफ्टवेयर रिपॉजिटरी उत्पन्न करने में सक्षम होता है।

Jane Luo, Xin Zhang, Steven Liu, Jie Wu, Jianfeng Liu, Yiming Huang, Yangyu Huang, Chengyu Yin, Ying Xin, Yuefeng Zhan (…)2026-02-16
💬 NLP

Evaluating the Creativity of LLMs in Persian Literary Text Generation

यह शोध पत्र एक टोरेन्स-आधारित ढांचे का उपयोग करते हुए विविध विषयों और अलंकारिक युक्तियों के माध्यम से फारसी साहित्यिक ग्रंथों को उत्पन्न करने में बड़े भाषा मॉडल (LLM) की रचनात्मकता का मूल्यांकन करता है, जो यह प्रदर्शित करता है कि स्वचालित LLM निर्णायक मानव मूल्यांकनों की तुलना में मौलिकता, प्रवाह, लचीलापन और विस्तार का विश्वसनीय रूप से आकलन कर सकते हैं।

Armin Tourajmehr, Mohammad Reza Modarres, Yadollah Yaghoobzadeh2026-02-16
💬 NLP

VoiceAgentBench: Are Voice Assistants ready for agentic tasks?

यह शोधपत्र VoiceAgentBench का परिचय देता है, जो कई भाषाओं और कार्य जटिलताओं में 6,000 से अधिक सिंथेटिक स्पोकन क्वेरीज़ वाला एक व्यापक बेंचमार्क है, जिससे यह पता चलता है कि हालांकि एजेन्टिक कार्यों में वर्तमान में ASR-LLM पाइपलाइन एंड-टू-एंड SpeechLM से बेहतर प्रदर्शन करती हैं, फिर भी सभी मॉडल क्रमिक वर्कफ़्लो (sequential workflows), बहुभाषी सामान्यीकरण और सुरक्षा सुदृढ़ता के साथ संघर्ष करते हैं।

Dhruv Jain, Harshit Shukla, Gautam Rajeev, Ashish Kulkarni, Chandra Khatri, Shubham Agarwal2026-02-16
💬 NLP

Segmentation Beyond Defaults: Asymmetrical Byte Pair Encoding for Optimal Machine Translation Performance

यह शोध पत्र प्रदर्शित करता है कि एसिमेट्रिक बाइट पेयर एनकोडिंगिंग (Byte Pair Encoding) का उपयोग करना, जो स्रोत और लक्ष्य भाषाओं के लिए अलग-अलग संख्या में मर्ज ऑपरेशन्स लागू करता है (विशेष रूप से स्रोत के लिए उच्च और लक्ष्य के लिए कम), मशीन अनुवाद में मानक सिमेट्रिक दृष्टिकोण की तुलना में काफी बेहतर प्रदर्शन करता है, विशेष रूप से कम-संसाधन वाले भाषा युग्मों के लिए।

Saumitra Yadav, Manish Shrivastava2026-02-16
💬 NLP

SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification

यह शोध पत्र SGM का प्रस्ताव करता है, जो एक व्हाइट-बॉक्स, पैरामीटर-मुक्त न्यूरॉन-स्तरीय हस्तक्षेप है जो मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स में विषाक्त विशेषज्ञ न्यूरॉन्स को चुनिंदा रूप से दबा देता है ताकि प्रवाह और तर्क क्षमताओं को संरक्षित करते हुए मानक और प्रतिकूल दोनों परिदृश्यों में हानिकारक आउटपुट को प्रभावी ढंग से कम किया जा सके।

Hongbo Wang, MaungMaung AprilPyone, Isao Echizen2026-02-16
💬 NLP

Finetuning Large Language Models for Automated Depression Screening in Nigerian Pidgin English: GENSCORE Pilot Study

यह पायलट अध्ययन प्रदर्शित करता है कि नाइजीरियाई पिडगिन इंग्लिश की एक क्यूरेटेड डेटासेट पर लार्ज लैंग्वेज मॉडल्स को फाइन-ट्यून करने से अत्यधिक सटीक (94.5%) और सांस्कृतिक रूप से उपयुक्त स्वचालित अवसाद स्क्रीनिंग सक्षम होती है, जो नाइजीरिया के कम सेवा वाले समुदायों में भाषा और पहुंच की बाधाओं को दूर करने के लिए एक स्केलेबल समाधान प्रदान करती है।

Isaac Iyinoluwa Olufadewa, Miracle Ayomikun Adesina, Ezekiel Ayodeji Oladejo, Uthman Babatunde Usman, Owen Kolade Adeniy (…)2026-02-16
💬 NLP

Assessing and Improving Punctuation Robustness in English-Marathi Machine Translation

यह शोध पत्र विराम (Viram) को पेश करता है, जो विराम चिह्न-अस्पष्ट अंग्रेजी-मराठी वाक्यों के लिए एक नैदानिक बेंचमार्क है, और यह प्रदर्शित करता है कि कैस्केड-आधारित विराम बहाली (punctuation restoration) और प्रत्यक्ष फाइन-ट्यूनिंग दोनों ही वर्तमान लार्ज लैंग्वेज मॉडल्स की तुलना में अनुवाद सुदृढ़ता में महत्वपूर्ण सुधार करते हैं।

Kaustubh Shivshankar Shejole, Sourabh Deoghare, Pushpak Bhattacharyya2026-02-16