💬 NLP

Anti-establishment sentiment on TikTok: Implications for understanding influence(rs) and expertise on social media

यह अध्ययन वित्त, कल्याण और षड्यंत्र सिद्धांत (कॉन्सपिरेसी थ्योरी) डोमेन में टिकटॉक पोस्ट का विश्लेषण करने के लिए एक कम्प्यूटेशनल दृष्टिकोण का उपयोग करता है, जिसमें यह पाया गया है कि हालांकि सत्ता-विरोधी भावना षड्यंत्र संबंधी सामग्री में सबसे अधिक प्रचलित है, फिर भी जुड़ाव के पैटर्न और प्लेटफॉर्म प्रोत्साहन यह सुझाव देते हैं कि यह इन विषयगत क्षेत्रों में उपयोगकर्ता के व्यवहार को प्रभावित कर सकता है।

Tianliang Xu, Ariel Hasell, Sabina Tomkins2026-05-21
⚡ electrical engineering

Enhancing Speech Large Language Models through Reinforced Behavior Alignment

यह शोध पत्र रिइन्फोर्स्ड बिहेवियर अलाइनमेंट (RBA) प्रस्तुत करता है, जो एक टीचर LLM से स्वयं-निर्मित डेटा और रिइन्फोर्समेंट लर्निंग का लाभ उठाता है ताकि स्पीच लार्ज लैंग्वेज मॉडल्स की निर्देश-अनुसरण करने की क्षमताओं को महत्वपूर्ण रूप से बढ़ाया जा सके, जिससे वे टेक्स्ट-आधारित समकक्षों से बेहतर प्रदर्शन करने में सक्षम होते हैं और मानव एनोटेशन पर निर्भर किए बिना स्पोकन टास्क पर अत्याधुनिक परिणाम प्राप्त करते हैं।

Yansong Liu, Jiateng Li, Yuan Liu2026-05-21
💬 NLP

Measuring and mitigating overreliance to build human-compatible AI

यह शोध पत्र तर्क देता है कि बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) पर अत्यधिक निर्भरता को मापना और कम करना उच्च-जोखिम वाली त्रुटियों और संज्ञानात्मक कौशल ह्रास (कॉग्निटिव डेस्किलिंग) को रोकने के लिए महत्वपूर्ण है, जो जोखिमों को समेकित करने, मापन संबंधी कमियों को दूर करने और ऐसी रणनीतियों को लागू करने के लिए एक रूपरेखा प्रस्तावित करता है जो यह सुनिश्चित करती है कि एआई मानवीय क्षमताओं को कम करने के बजाय उन्हें सुदृढ़ करे।

Lujain Ibrahim, Katherine M. Collins, Sunnie S. Y. Kim, Anka Reuel, Max Lamparth, Kevin Feng, Lama Ahmad, Prajna Soni, A (…)2026-05-21
💬 NLP

Retrieval-Augmented Code Generation: A Survey with Focus on Repository-Level Approaches

यह सर्वेक्षण रिपॉजिटरी-स्तरीय दृष्टिकोणों पर विशिष्ट ध्यान केंद्रित करते हुए रिट्रीवल-ऑगमेंटेड कोड जनरेशन (RACG) की एक व्यापक समीक्षा प्रदान करता है, जो बड़े भाषा मॉडलों को संपूर्ण सॉफ्टवेयर रिपॉजिटरी में सुसंगत कोड उत्पन्न करने में सक्षम बनाने के लिए रिट्रीवल रणनीतियों, स्वायत्त एजेंटों और प्रमुख चुनौतियों का परीक्षण करने हेतु एक एकीकृत विश्लेषणात्मक ढांचा प्रस्तुत करता है।

Yicheng Tao, Yuante Li, Yao Qin, Yepang Liu2026-05-21
💬 NLP

EvalMORAAL: Interpretable Chain-of-Thought and LLM-as-Judge Evaluation for Moral Alignment in Large Language Models

EvalMORAAL एक पारदर्शी, व्याख्या योग्य ढांचा है जो वैश्विक सर्वेक्षण डेटा के विरुद्ध 20 बड़े भाषा मॉडलों (LLMs) में नैतिक संरेखण का मूल्यांकन करता है, जो मजबूत समग्र सहसंबंधों के साथ-साथ पश्चिमी और गैर-पश्चिमी क्षेत्रों के बीच 0.21-पॉइंट का महत्वपूर्ण संरेखण अंतराल प्रकट करता है।

Hadi Mohammadi, Anastasia Giachanou, Robert A. Bagheri2026-05-21
💬 NLP

The Visual Iconicity Challenge: Evaluating Vision-Language Models on Sign Language Form-Meaning Mapping

यह शोध पत्र विजुअल आइकनिसिटी चैलेंज (Visual Iconicity Challenge) को प्रस्तुत करता है, जो एक नवीन वीडियो-आधारित बेंचमार्क है जो गतिशील सांकेतिक भाषा रूपों को अर्थों के साथ मैप करने की क्षमता पर 13 अत्याधुनिक विजन-लैंग्वेज मॉडल्स का मूल्यांकन करता है, जिससे यह पता चलता है कि हालांकि वर्तमान मॉडल दृश्य रूप से आधारित संरचनाओं के प्रति कुछ संवेदनशीलता दिखाते हैं, फिर भी वे ध्वन्यात्मक रूपों की भविष्यवाणी करने और आइकनिसिटी से अर्थ निकालने में मानव प्रदर्शन से काफी पीछे हैं।

Onur Keleş, Aslı Özyürek, Gerardo Ortega, Kadir Gökgöz, Esam Ghaleb2026-05-21
💬 NLP

Towards Consistent Detection of Cognitive Distortions: LLM-Based Annotation and Dataset-Agnostic Evaluation

यह शोध पत्र संज्ञानात्मक विरूपण (cognitive distortion) का पता लगाने के व्यक्तिपरक कार्य के लिए सुसंगत एनोटेशन उत्पन्न करने हेतु कई स्वतंत्र LLM रन का उपयोग करने का प्रस्ताव देता है और कोहेन के कप्पा (Cohen's kappa) पर आधारित एक डेटासेट-अज्ञेय (dataset-agnostic) मूल्यांकन ढांचे को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि LLM-जनित डेटा मानव-लेबल वाले डेटा की तुलना में बेहतर मॉडल प्रदर्शन प्रदान करता है।

Neha Sharma, Navneet Agarwal, Kairit Sirts2026-05-21
💬 NLP

Generative AI Practices, Literacy, and Divides: An Empirical Analysis in the Italian Context

1,906 इतालवी वयस्कों के एक सर्वेक्षण के आधार पर, यह अध्ययन प्रकट करता है कि जबकि जनरेटिव एआई को विविध गतिविधियों के लिए तेजी से अपनाया जा रहा है, इसके लाभ शिक्षा, आयु, तकनीकी परिचितता और लिंग द्वारा संचालित अपनाने और उपयोग के पैटर्न में महत्वपूर्ण विभाजनों के कारण असमान रूप से वितरित हैं, जिसमें पूंजी-बढ़ाने वाले अनुप्रयोगों में संलग्न होने के लिए विशेष प्रशिक्षण एक महत्वपूर्ण कारक के रूप में उभर रहा है।

Beatrice Savoldi, Giuseppe Attanasio, Olga Gorodetskaya, Marta Marchiori Manerba, Elisa Bassignana, Silvia Casola, Matte (…)2026-05-21
🧬 biology

DNACHUNKER: Learnable Tokenization for DNA Language Models

यह शोध पत्र DNAChunker प्रस्तुत करता है, जो एक DNA भाषा मॉडल है जिसमें एक सीखने योग्य अनुकूलन योग्य विभाजन मॉड्यूल (learnable adaptive segmentation module) है जो जैविक संदर्भ को बेहतर ढंग से पकड़ने के लिए गतिशील रूप से परिवर्तनशील-लंबाई वाले टोकन उत्पन्न करता है और कई बेंचमार्क में फिक्स्ड-टोकनाइजेशन बेसलाइन की तुलना में प्रदर्शन में सुधार करता है।

Taewon Kim, Jihwan Shin, Hyomin Kim, Youngmok Jung, Jonghoon Lee, Won-Chul Lee, Sungsoo Ahn, Insu Han2026-05-21
💬 NLP

Improving Indigenous Language Machine Translation with Synthetic Data and Language-Specific Preprocessing

यह शोध पत्र यह प्रदर्शित करता है कि सिंथेटिक डेटा के साथ कम-संसाधन वाली स्वदेशी भाषा के डेटासेट को संवर्धित करना और भाषा-विशिष्ट प्रीप्रोसेसिंग लागू करना न्यूरल मशीन ट्रांसलेशन प्रदर्शन में महत्वपूर्ण सुधार करता है, जैसा कि गुआरानी-स्पेनिश और क्वेशुआ-स्पेनिश अनुवाद कार्यों में chrF++ स्कोर की वृद्धि से सिद्ध होता है।

Aashish Dhawan, Christopher Driggers-Ellis, Christan Grant, Daisy Zhe Wang2026-05-21