💬 NLP

SPLIT: Cross-Lingual Empathy and Cultural Grounding in English and Ukrainian LLM Responses

यह शोध पत्र SPLIT को प्रस्तुत करता है, जो एक 500-प्रॉम्प्ट बेंचमार्क है जो अंग्रेजी और यूक्रेनी एलएलएम (LLM) प्रतिक्रियाओं में क्रॉस-लिंगुअल सहानुभूति और सांस्कृतिक आधार का मूल्यांकन करता है, जो कुछ मॉडलों के लिए यूक्रेनी में महत्वपूर्ण प्रदर्शन गिरावट, मानव और एआई मूल्यांकनकर्ताओं के बीच कमजोर सहमति, और यूक्रेनी पाठ उत्पन्न करने तथा सांस्कृतिक रूप से उपयुक्त भावनात्मक सहायता प्रदान करने के बीच महत्वपूर्ण अंतर को प्रकट करता है।

Anna Chorna2026-07-03
💬 NLP

HaloGuard 1.0: An Open Weights Constitutional Classifier for Multilingual AI Safety

HaloGuard 1.0 एक ओपन-वेट्स, कॉन्स्टिट्यूशनल क्लासिफायर है जो बड़े बेसलाइन्स की तुलना में काफी छोटे मॉडल आकार (0.8B–4B पैरामीटर्स) का लाभ उठाते हुए, एक संरचित 46-नीति संविधान और सिंथेटिक काउंटरफैक्चुअल डेटा का उपयोग करके स्टेट-ऑफ-द-आर्ट बहुभाषी AI सुरक्षा प्रदर्शन प्राप्त करता है ताकि फॉल्स पॉजिटिव और फॉल्स नेगेटिव दोनों को न्यूनतम किया जा सके।

Navaneeth Sangameswaran, Preetham S, Ashmiya Lenin2026-07-03
💬 NLP

ESC: Emotional Self-Correction for Reliable Vision-Language Models

यह शोध पत्र ESC (इमोशनल सेल्फ-करेक्शन) का प्रस्ताव करता है, जो एक प्रशिक्षण-मुक्त ढांचा है जो विजन-लैंग्वेज मॉडल्स में लेटेंट सेल्फ-करेक्शन व्यवहारों को ट्रिगर करने के लिए इमोशनल क्यूज़ को एक कंट्रोल सिग्नल के रूप में उपयोग करता है, जिससे बिना किसी अतिरिक्त फाइन-ट्यूनिंग के उनकी विश्वसनीयता और तर्क क्षमता में सुधार होता है।

Tien-Huy Nguyen, Minh-Nhat Nguyen, Nguyen Nhat Huy, Hung Viet Nguyen, Huy Nguyen Minh Nhat, Thanh-Huy Nguyen, Cuong Tuan (…)2026-07-03
⚡ electrical engineering

Unlocking Speech-Text Compositional Powers: Instruction-Following Speech Language Models without Instruction Tuning

यह शोध पत्र SpeechCombine को प्रस्तुत करता है, जो एक अभिनव दृष्टिकोण है जो एक स्पीच-अनुकूलित मॉडल को एक इंस्ट्रक्शन-ट्यून्ड टेक्स्ट LLM के वेट डिफरेंस (weight differences) के साथ सीधे जोड़कर एक इंस्ट्रक्शन-फॉलोइंग स्पीच लैंग्वेज मॉडल बनाता है, जिससे बड़े पैमाने पर स्पीच इंस्ट्रक्शन-ट्यूनिंग डेटासेट की आवश्यकता के बिना भी मजबूत कंपोजिशनल क्षमताएं प्राप्त होती हैं।

Congrui Du, Yang Zhang, Kaizhi Qian, Shiyu Chang2026-07-03
💬 NLP

Challenges and Recommendations for LLMs-as-a-Judge in Multilingual Settings and Low-Resource Languages

यह शोध पत्र एनएलपी (NLP) समुदाय के भीतर बहुभाषी और कम-संसाधन वाली भाषाओं के परिवेश में 'एलएलएम-एज़-ए-जज' (LLM-as-a-Judge) के सीमित और अक्सर असंगत अनुप्रयोग का विश्लेषण करता है, जो अत्यधिक विश्वास (overtrust) और एकल-मॉडल निर्भरता जैसे जोखिमों को उजागर करते हुए अधिक सुदृढ़ मूल्यांकन प्रथाओं के लिए सिफारिशें प्रदान करता है।

A. Seza Doğruöz, Xixian Liao, Verena Blaschke, Jakob Prange, Senyu Li, David Ifeoluwa Adelani2026-07-03
💬 NLP

BamiBERT: A New BERT-based Language Model for Vietnamese

BamiBERT वियतनामी भाषा के लिए एक नया BERT-आधारित प्री-ट्रेंड लैंग्वेज मॉडल है जो, बिना किसी बाहरी शब्द विभाजन के 129GB कॉर्पस पर स्क्रैच से प्रशिक्षण देकर और विस्तारित संदर्भ लंबाई का समर्थन करके, कई बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करता है और वर्तमान मानक, PhoBERT से आगे निकल जाता है।

Dat Quoc Nguyen, Thinh Pham, Chi Tran, Linh The Nguyen2026-07-03
💬 NLP

CheckRLM: Effective Knowledge-Thought Coherence Checking in Retrieval-Augmented Reasoning

CheckRLM एक ऐसा फ्रेमवर्क है जो रीजनिंग चेन से तथ्यात्मक दावों को निकालकर, रिट्रीवल-ऑगमेंटेड जनरेशन के माध्यम से ज्ञान संबंधी विसंगतियों का पता लगाने और उन्हें सुधारने द्वारा रीजनिंग लैंग्वेज मॉडल्स की विश्वसनीयता को बढ़ाता है, जिससे जटिल, ज्ञान-गहन कार्यों में त्रुटि संचय को कम किया जा सके।

Dingling Xu, Ruobing Wang, Qingfei Zhao, Yukun Yan, Zhichun Wang, Daren Zha, Shi Yu, Zhenghao Liu, Shuo Wang, Xu Han, Ma (…)2026-07-03
💬 NLP

HERMES: A Multi-Granularity Labeling Substrate for Pre-training Data Mixtures

HERMES एक पुन: प्रयोज्य, डेटा-व्युत्पन्न पदानुक्रमित लेबलिंग सबस्ट्रेट पेश करता है जो विभिन्न रिज़ॉल्यूशन के माध्यम से इष्टतम डेटा मिश्रण रणनीतियों की खोज को सक्षम करने के लिए सीखे गए सिमेंटिक ट्रांसफॉर्म और रेसिडुअल वेक्टर क्वांटाइजेशन का उपयोग करता है, जिसे निश्चित-ग्रैनुलैरिटी विधियाँ परीक्षण नहीं कर सकती हैं।

Ziyun Qiao, Yue Min, Ruining Chen, Yujun Li2026-07-03
💬 NLP

SkillFuzz: Fuzzing Skill Composition for Implicit Intents Discovery in Open Skill Marketplaces

यह शोध पत्र SkillFuzz को प्रस्तुत करता है, जो पहला निष्पादन-मुक्त (execution-free) फज़िंग फ्रेमवर्क है जो ओपन LLM-आधारित एजेंट मार्केटप्लेस में स्किल कंपोजिशन से उत्पन्न होने वाले उच्च-जोखिम वाले निहित इरादों (implicit intents) को कुशलतापूर्वक खोजने और प्राथमिकता देने के लिए संरचित स्किल कॉन्ट्रैक्ट्स और कॉन्ट्रैक्ट-गाइडेड मोंटे कार्लो ट्री सर्च का उपयोग करता है।

Jinwei Hu, Yi Dong, Youcheng Sun, Xiaowei Huang2026-07-03
⚡ electrical engineering

Audio-Based Understanding of Audiobook Narration Appeal

यह अध्ययन पहला व्यवस्थित कम्प्यूटेशनल विश्लेषण प्रस्तुत करता है जो यह प्रदर्शित करता है कि ऑडियोबुक वर्णन से निकाले गए स्वर और ध्वनिक लक्षण विभिन्न शैलियों और शीर्षकों में श्रोता अपील की मजबूती से भविष्यवाणी करते हैं, जो वैयक्तिकरण और नैरेटर कास्टिंग के लिए मूल्यवान डेटा-संचालित अंतर्दृष्टि प्रदान करते हैं।

Shahar Elisha, Mariano Beguerisse-Díaz, Emmanouil Benetos2026-07-03