🤖 AI

ComplexConstraints and Beyond: Expert Rubrics for RLVR

यह शोधपत्र ComplexConstraints को प्रस्तुत करता है, जो रूब्रिक-आधारित मूल्यांकन के लिए एक विशेषज्ञ-क्यूरेटेड डेटासेट और फ्रेमवर्क है, जो यह प्रदर्शित करता है कि उच्च-गुणवत्ता वाले, परमाणु (atomic) रूब्रिक्स न केवल जटिल LLM व्यवहारों का बेहतर मूल्यांकन प्रदान करते हैं, बल्कि अत्यधिक प्रभावी प्रशिक्षण संकेत के रूप में भी कार्य करते हैं जो विभिन्न आकार के मॉडलों में निर्देश-अनुपालन और एजेंटिक कार्य प्रदर्शन को महत्वपूर्ण रूप से बढ़ाते हैं।

Sushant Mehta, Liudas Panavas, Edwin Chen2026-06-09
🤖 AI

A Regret Minimization Framework on Preference Learning in Large Language Models

यह शोध पत्र रिग्रेट-आधारित प्रेफरेंस ऑप्टिमाइज़ेशन (RePO) को प्रस्तुत करता है, जो एक नवीन ढांचा है जो मानव फीडबैक से सुदृढीकरण लर्निंग (reinforcement learning) को रिग्रेट मिनिमाइजेशन के माध्यम से पुनर्गठित करता है ताकि मानव प्राथमिकताओं की संभावित और प्रतितथ्यात्मक प्रकृति को बेहतर ढंग से समझा जा सके, जिसके परिणामस्वरूप रीजनिंग और प्रेफरेंस बेंचमार्क पर निरंतर प्रदर्शन लाभ प्राप्त होते हैं।

Suhwan Kim, Taehyun Cho, Geon-Hyeong Kim, Yu Jin Kim, Youngsoo Jang, Moontae Lee, Jungwoo Lee2026-06-09
🤖 AI

Unveiling Privacy Risks in Multi-modal Large Language Models: Task-specific Vulnerabilities and Mitigation Challenges

यह शोध पत्र मल्टी-मोडल लार्ज लैंग्वेज मॉडल्स (MLLMs) में अद्वितीय गोपनीयता जोखिमों का व्यवस्थित रूप से मूल्यांकन करने और उन्हें उजागर करने के लिए MM-Privacy डेटासेट प्रस्तुत करता है, जो विभिन्न कार्यों में छवियों या मेमोरी में अंतर्निहित संवेदनशील जानकारी को लीक करने के प्रति उनकी संवेदनशीलता को प्रदर्शित करता है और लक्षित शमन रणनीतियों की तत्काल आवश्यकता पर प्रकाश डालता है।

Tiejin Chen, Pingzhi Li, Kaixiong Zhou, Tianlong Chen, Hua Wei2026-06-09
🤖 AI

Vision Language Model Helps Private Information De-Identification in Vision Data

यह शोध पत्र VisShield को प्रस्तुत करता है, जो OPTIC डेटासेट और एक अनुकूलित प्रशिक्षण पद्धति से युक्त एक एंड-टू-एंड फ्रेमवर्क है, जो विजुअल डेटा में संवेदनशील टेक्स्ट को सटीक रूप से स्थानीयकृत और मास्क करने की विजन लैंग्वेज मॉडल्स की क्षमता को बढ़ाता है ताकि संरक्षित स्वास्थ्य जानकारी (PHI) जैसे अनदेखे गोपनीयता जोखिमों को संबोधित किया जा सके।

Tiejin Chen, Pingzhi Li, Kaixiong Zhou, Tianlong Chen, Hua Wei2026-06-09
🤖 AI

Decoding Pedestrian Crossing Intention from Egocentric Vision via Vision Language Models

यह शोध पत्र इस कार्य को विजुअल क्वेश्चन अनस्वर्सिंग (VQA) के रूप में फ्रेम करके एगोसेंट्रिक वीडियो से पैदल यात्री क्रॉसिंग की मंशा को डिकोड करने का प्रस्ताव देता है, जो यह प्रदर्शित करता है कि विजन लैंग्वेज मॉडल्स (VLMs) का पैरामीटर-कुशल फाइन-ट्यूनिंग—विशेष रूप से जब आई गेज़ और मोशन जैसे प्रासंगिक संकेतों के साथ संवर्धित हो—जीरो-शॉट VLMs और विशिष्ट ट्रांसफार्मर बेसलाइन्स दोनों से काफी बेहतर प्रदर्शन करता है ताकि एक नया स्टेट ऑफ द आर्ट स्थापित किया जा सके।

Danya Li, Xiang Su, Yan Feng, Rico Krueger2026-06-09
💬 NLP

SEF-CLGC at SemEval-2026 Task 11: Logical Notation Impact on Language Model Performance

यह शोध पत्र SEF-CLGC पाइपलाइन प्रस्तुत करता है, जो SemEval-2026 टास्क 11 पर 27.80% कंटेंट स्कोर प्राप्त करने के लिए स्मॉल लैंग्वेज मॉडल्स के साथ औपचारिक तार्किक नोटेशन को एकीकृत करता है और साथ ही तर्क में कंटेंट बायस (सामग्री पूर्वाग्रह) को महत्वपूर्ण रूप से कम करता है।

Hanna Abi Akl, Fabien Gandon, Catherine Faron, Pierre Monnin2026-06-09
🤖 machine learning

Crop Recommendation and Agricultural Query Answering System Using Spatio-Temporal Graph Neural Networks and Hybrid Retrieval Augmentation

यह शोध पत्र नेपाल में सटीक कृषि के लिए एक एकीकृत मोबाइल-आधारित प्रणाली प्रस्तुत करता है जो 30-दिवसीय मौसम पूर्वानुमान के लिए स्पैटियो-टेम्पोरल ग्राफ कन्वोल्यूशनल नेटवर्क, मिट्टी और मौसम के डेटा के आधार पर स्थानीयकृत फसल सिफारिशों के लिए एक स्कोरिंग एल्गोरिदम, और किसानों को कार्रवाई योग्य, प्राकृतिक भाषा मार्गदर्शन प्रदान करने के लिए एक रिट्रीवल-ऑगमेंटेड जनरेशन चैटबॉट को एकीकृत करता है।

Prajwal Thapa, Yagya Raj Pandeya2026-06-09
🤖 AI

Pretrained, Frozen, Still Leaking: Auditing Cross-Encoder Attribute Transfer in EEG Foundation Models

यह शोध पत्र एक क्रॉस-एनकोडर ऑडिट फ्रेमवर्क प्रस्तुत करता है जो यह प्रदर्शित करता है कि प्रीट्रेंड ईईजी फाउंडेशन मॉडल्स (BIOT, LaBraM, EEGPT), सिंगल-एंडपॉइंट सुरक्षा जांच पास करने के बावजूद, सभी परीक्षण किए गए एंडपॉइंट्स में स्पेक्ट्रल एट्रिब्यूट्स को लीक करते हैं, जो एक ऐसी भेद्यता है जो DP-SGD और LiRA जैसे मानक रक्षा उपायों के तहत भी बनी रहती है।

Jianwei Tai2026-06-09
🤖 AI

MASS: Deep Research for Social Sciences with Memory-Augmented Social Simulation

यह शोध पत्र MASS का प्रस्ताव करता है, जो एक मेमोरी-ऑगमेंटेड सोशल सिमुलेशन फ्रेमवर्क है जो डायनेमिक गोल-पाथ प्लानिंग, मल्टी-डिसिप्लिनरी बिहेवियर डेटासेट्स और एक स्ट्रक्चर्ड फॉरगेटिंग मैकेनिज्म को एकीकृत करके LLM-संचालित सामाजिक विज्ञान अनुसंधान की रचनात्मकता और अनुभवजन्य कठोरता को बढ़ाता है, जिससे मौजूदा बेसलाइन्स की तुलना में समग्र गुणवत्ता और अंतर्दृष्टि में महत्वपूर्ण सुधार प्राप्त होता है।

Yongrui Liu, Deyi Xiong2026-06-09
🤖 AI

End-to-End Training for Discrete Token LLM based TTS System

यह शोध पत्र एक पूर्ण एंड-टू-एंड प्रशिक्षण ढांचे का प्रस्ताव करता है जो डिस्क्रीट टोकन-आधारित टीटीएस (TTS) घटकों को एकीकृत करने के लिए एक स्पीच टोकेनाइज़र, ऑटोरेग्रेसिव एलएलएम (LLM), फ्लो-मैचिंग मॉडल और रिवॉर्ड मॉडल को संयुक्त रूप से अनुकूलित करता है, जिससे पारंपरिक कैस्केडेड दृष्टिकोणों की तुलना में काफी सरल पाइपलाइन के साथ नया स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त होता है।

Changfeng Gao, Yong Ren, Jun Yuan, Ye Bai, Zhao You, ShiDong Shang2026-06-09