💻 computer science

IRIS: Interleaved Reinforcement with Incremental Staged Curriculum for Cross-Lingual Mathematical Reasoning

यह शोध पत्र IRIS को प्रस्तुत करता है, जो एक नवीन ढांचा है जो इंटरलीव्ड रीइन्फोर्समेंट लर्निंग को एक इंक्रीमेंटल स्टेज्ड करिकुलम और एक नए बहुभाषी डेटासेट (CL-Math) के साथ जोड़ता है ताकि क्रॉस-लिंगुअल गणितीय तर्क क्षमताओं, विशेष रूप से कम-संसाधन वाली भारतीय भाषाओं में, को महत्वपूर्ण रूप से बढ़ाया जा सके।

Navya Gupta, Rishitej Reddy Vyalla, Avinash Anand, Chhavi Kirtani, Erik Cambria, Zhengchen Zhang, Zhengkui Wang, Timothy (…)2026-04-28
💻 computer science

MemeScouts@LT-EDI 2026: Asking the Right Questions -- Prompted Weak Supervision for Meme Hate Speech Detection

यह शोध पत्र एक क्वांटाइज्ड Qwen3-VLM का उपयोग करते हुए एक प्रॉम्प्टेड वीक सुपरविजन फ्रेमवर्क प्रस्तावित करता है जो मीम हेट स्पीच डिटेक्शन को लक्षित प्रश्न-आधारित लेबलिंग फंक्शन्स में विभाजित करता है, जिससे मल्टीमॉडल, सांस्कृतिक रूप से सूक्ष्म और बहुभाषी हेट स्पीच की चुनौतियों को प्रभावी ढंग से संबोधित करते हुए LT-EDI 2026 साझा कार्य के लिए अंग्रेजी, चीनी और हिंदी में शीर्ष रैंकिंग प्राप्त की गई है।

Ivo Bueno, Lea Hirlimann, Enkelejda Kasneci2026-04-28
💻 computer science

Seeing Is No Longer Believing: Frontier Image Generation Models, Synthetic Visual Evidence, and Real-World Risk

यह शोध पत्र उन उभरते जोखिमों का विश्लेषण करता है जो फ्रंटियर इमेज जनरेशन मॉडल्स से उत्पन्न होते हैं जो यथार्थवाद, पठनीय पाठ और पहचान की निरंतरता के साथ सिंथेटिक दृश्य साक्ष्य उत्पन्न करते हैं, और यह तर्क देता है कि ये क्षमताएं दृश्य अभिलेखों में सामाजिक विश्वास को कमजोर करती हैं और विभिन्न क्षेत्रों में तकनीकी, क्रिप्टोग्राफिक और नीतिगत हस्तक्षेपों वाले एक बहु-स्तरीय नियंत्रण ढांचे को आवश्यक बनाती हैं।

Shuai Wu, Xue Li, Yanna Feng, Yufang Li, Zhijun Wang, Ran Wang2026-04-28
💻 computer science

OS-SPEAR: A Toolkit for the Safety, Performance,Efficiency, and Robustness Analysis of OS Agents

यह शोध पत्र OS-SPEAR को प्रस्तुत करता है, जो एक व्यापक टूलकिट है जिसे विशेष उपसमुच्चयों और स्वचालित निदान के माध्यम से सुरक्षा, प्रदर्शन, दक्षता और मजबूती के आयामों में OS एजेंटों का व्यवस्थित रूप से मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो अधिक विश्वसनीय एजेंटों के विकास को निर्देशित करने के लिए वर्तमान मॉडलों में महत्वपूर्ण ट्रेड-ऑफ और कमजोरियों को प्रकट करता है।

Zheng Wu, Yi Hua, Zhaoyuan Huang, Chenhao Xue, Yijie Lu, Pengzhou Cheng, Zongru Wu, Lingzhong Dong, Gongshen Liu, Xingha (…)2026-04-28
💻 computer science

MIPIC: Matryoshka Representation Learning via Self-Distilled Intra-Relational and Progressive Information Chaining

यह शोध पत्र MIPIC का प्रस्ताव करता है, जो एक एकीकृत प्रशिक्षण ढांचा है जो सेल्फ-डिस्टिल्ड इंट्रा-रिलेशनल एलाइनमेंट और प्रोग्रेसिव इंफॉर्मेशन चेनिंग को जोड़कर मैट्रोष्का रिप्रेजेंटेशन लर्निंग को उन्नत करता है ताकि संरचनात्मक रूप से सुसंगत और अर्थपूर्ण रूप से सघन एम्बेडिंग उत्पन्न की जा सकें जो विभिन्न कम्प्यूटेशनल बजट और मॉडल आकारों में उच्च प्रदर्शन बनाए रखते हैं।

Phung Gia Huy, Hai An Vu, Minh-Phuc Truong, Thang Duc Tran, Linh Ngo Van, Thanh Hong Nguyen, Trung Le2026-04-28
💻 computer science

Learning Evidence of Depression Symptoms via Prompt Induction

यह शोध पत्र 'सिम्पटम इंडक्शन' (Symptom Induction) को प्रस्तुत करता है, जो एक नवीन विधि है जो लेबल किए गए उदाहरणों को व्याख्या योग्य दिशा-निर्देशों में संकुचित करती है ताकि उपयोगकर्ता द्वारा जनरेट किए गए टेक्स्ट में सूक्ष्म अवसाद संबंधी लक्षणों के वर्गीकरण में महत्वपूर्ण सुधार किया जा सके, जो मानक एलएलएम (LLM) दृष्टिकोणों से बेहतर प्रदर्शन करता है और संबंधित मानसिक स्वास्थ्य स्थितियों के प्रति मजबूत सामान्यीकरण प्रदर्शित करता है।

Eliseo Bao, Anxo Perez, David Otero, Javier Parapar2026-04-28
⚡ electrical engineering

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation

यह शोध पत्र एक नैदानिक ढांचे (diagnostic framework) को प्रस्तुत करता है जो यह प्रकट करता है कि कई लार्ज ऑडियो-लैंग्वेज मॉडल्स वास्तविक श्रवण बोध के बजाय टेक्स्ट प्रायर्स (text priors) और स्थानीयकृत ऑडियो अंशों पर निर्भर करके उच्च बेंचमार्क स्कोर प्राप्त करते हैं, जो यह सुझाव देता है कि वर्तमान मूल्यांकन अक्सर वास्तविक ऑडियो समझ को मापने में विफल रहते हैं।

Leonardo Haw-Yang Foo, Chih-Kai Yang, Chen-An Li, Ke-Han Lu, Hung-yi Lee2026-04-28
💻 computer science

Can You Make It Sound Like You? Post-Editing LLM-Generated Text for Personal Style

यह अध्ययन पाता है कि जबकि LLM-जनित प्रारूपों का पोस्ट-एडिटिंग (संपादन) उपयोगकर्ताओं को अपनी कुछ व्यक्तिगत शैली को शामिल करने में मदद करता है, परिणामी पाठ मूल मॉडल आउटपुट के अधिक निकट रहता है न कि बिना सहायता वाले मानव लेखन के, और इसमें कम विविधता दिखाई देती है, जो कथित प्रामाणिकता और मापने योग्य शैलीगत समानता के बीच एक अंतर पैदा करता है।

Connor Baumler, Calvin Bao, Huy Nghiem, Xinchen Yang, Marine Carpuat, Hal Daumé III2026-04-28
💻 computer science

Zero-shot Large Language Models for Automatic Readability Assessment

यह शोध पत्र एक ज़ीरो-शॉट प्रॉम्प्टिंग पद्धति और LAURAE नामक एक हाइब्रिड मॉडल प्रस्तुत करता है जो विविध डेटासेट, भाषाओं और पाठ प्रकारों में अत्याधुनिक, सुदृढ़ अनसुपरवाइज्ड (unsupervised) स्वचालित पठनीयता मूल्यांकन प्राप्त करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाते हैं।

Riley Grossman, Yi Chen2026-04-28
💻 computer science

Agentic clinical reasoning over longitudinal myeloma records: a retrospective evaluation against expert consensus

यह पूर्वव्यापी अध्ययन प्रदर्शित करता है कि एक एजेंटिक क्लिनिकल रीजनिंग सिस्टम, विशेषज्ञ सर्वसम्मति से मेल खाने के लिए मल्टीपल मायलोमा के अनुदैर्ध्य (लॉन्गीटुडिनल) रिकॉर्ड्स को संश्लेषित करने में मानक RAG और फुल-कॉन्टेक्स्ट दृष्टिकोणों से बेहतर प्रदर्शन करता है, विशेष रूप से जटिल मामलों में, हालांकि इसके अवशिष्ट त्रुटियों की उच्च गंभीरता नैदानिक तैनाती से पहले भावी सत्यापन (प्रोस्पेक्टिव वैलिडेशन) को आवश्यक बनाती है।

Johannes Moll, Jannik Lübberstedt, Christoph Nuernbergk, Jacob Stroh, Luisa Mertens, Anna Purcarea, Christopher Zirn, Ze (…)2026-04-28