🤖 AI

Going PLACES: Participatory Localized Red Teaming for Text-to-Image Safety in the Global South

यह शोध पत्र PLACES को प्रस्तुत करता है, जो एक सहभागी रेड टीमिंग पहल है जो ग्लोबल साउथ के समुदायों के साथ सहयोग करके 26,000 से अधिक स्थानीयकृत विफलता उदाहरणों का एक विविध डेटासेट तैयार करती है, जिससे टेक्स्ट-टू-इमेज सुरक्षा में पश्चिमी-केंद्रित पूर्वाग्रहों को संबोधित किया जाता है, अद्वितीय सांस्कृतिक नुकसानों को उजागर किया जाता है और संदर्भ-जागरूक सुरक्षा ढांचों की वकालत की जाती है।

Charvi Rastogi, Mukul Bhutani, Minsuk Kahng, Shamsuddeen Hassan Muhammad, Evgeniia Razumovskaia, Priyanka Suresh, Ibrahi (…)2026-05-20
🤖 AI

Hallucination as Exploit: Evidence-Carrying Multimodal Agents

यह शोध पत्र एविडेंस-कैरिंग मल्टीमॉडल एजेंट्स (ECA) को पेश करता है, जो एक सुरक्षित आर्किटेक्चर है जो मॉडल के अपुष्ट संवेदी दावों पर भरोसा करने के बजाय टूल कॉल्स को टाइप किए गए, बाहरी साक्ष्य प्रमाणपत्रों के विरुद्ध मान्य करने की आवश्यकता के माध्यम से मतिभ्रम-जनित (hallucination-driven) प्राधिकरण विफलताओं को रोकता है।

Guijia Zhang, Hao Zheng, Harry Yang2026-05-20
🔢 mathematics

Aerial Inspection Behaviors via RL-based Quadrotor Control for Under-canopy Forest Environments

यह शोध पत्र अंडर-कैनोपी (वृक्षों के नीचे) वन निरीक्षण के लिए एक स्वायत्त क्वाड्रोटर प्रणाली प्रस्तुत करता है जो सटीक व्यू-पोज़ ट्रैकिंग के लिए डीप रीइन्फोर्समेंट लर्निंग-आधारित लो-लेवल कंट्रोलर को एक हाई-लेवल नेविगेशन स्टैक के साथ जोड़ता है, जिसमें सुरक्षित और लंबी दूरी के मिशन निष्पादन सुनिश्चित करने के लिए TSP और RRT* प्लानर्स का उपयोग किया गया है।

Fausto Mauricio Lagos Suarez, Akshit Saradagi, Vidya Sumathy, Viswa Narayanan Sankaranarayanan, George Nikolakopoulos2026-05-20
🤖 AI

Quantized Machine Learning Models for Medical Imaging in Low-Resource Healthcare Settings

यह शोध पत्र ब्रेन ट्यूमर वर्गीकरण के लिए एक मल्टी-स्ट्रेटजी कंप्रेशन फ्रेमवर्क प्रस्तुत करता है जो, एक Float16 क्वांटाइज्ड MobileNetV2 मॉडल के पूर्ण प्रयोगात्मक सत्यापन के माध्यम से, मॉडल के आकार में 6.14x की कमी लाने और नगण्य सटीकता हानि के साथ, कम संसाधनों वाले स्वास्थ्य सेवा परिवेशों में नैदानिक रूप से व्यवहार्य परिनियोजन को सक्षम करने की क्षमता प्रदर्शित करता है।

Sumanth Meenan Kanneti, Aryan Shah2026-05-20
🤖 AI

Not all uncertainty is alike: volatility, stochasticity, and exploration

यह शोध पत्र प्रदर्शित करता है कि पर्यावरणीय अनिश्चितता के विशिष्ट स्रोत—विशेष रूप से अस्थिरता (volatility) और स्टोकेस्टिसिटी (stochasticity)—इष्टतम अन्वेषण (optimal exploration) को विपरीत दिशाओं में संचालित करते हैं, जिससे CAUSE एल्गोरिदम का विकास होता है जो इस विषमता का लाभ उठाकर मानक रणनीतियों से बेहतर प्रदर्शन करता है और मनोरोग संबंधी स्थितियों में रोगजनक शोर अनुमान (pathological noise inference) के संबंध में नई अंतर्दृष्टि प्रदान करता है।

Payam Piray2026-05-20
🤖 AI

SimGym: A Framework for A/B Test Simulation in E-Commerce with Traffic-Grounded VLM Agents

SimGym एक ऐसा फ्रेमवर्क है जो लाइव ब्राउज़र में संचालित होने वाले ट्रैफिक-ग्राउंडेड विजन-लैंग्वेज मॉडल एजेंटों का लाभ उठाता है ताकि ई-कॉमर्स ए/बी टेस्ट का तेजी से और सटीक रूप से अनुकरण किया जा सके, जो वास्तविक परिणामों के साथ 77% दिशात्मक संरेखण (directional alignment) प्राप्त करता है और वास्तविक उपयोगकर्ताओं को अपुष्ट वेरिएंट्स के संपर्क में लाए बिना प्रायोगिक चक्रों को हफ्तों से घटाकर एक घंटे से भी कम कर देता है।

Han Li, Vibhor Malik, Zahra Zanjani Foumani, Alberto Castelo, Shuang Xie, Ailin Fan, Keat Yang Koay, Yuanzheng Zhu, Meys (…)2026-05-20
💬 NLP

Position: Uncertainty Quantification in LLMs is Just Unsupervised Clustering

यह शोध पत्र तर्क देता है कि लार्ज लैंग्वेज मॉडल्स के लिए वर्तमान अनिश्चितता मात्रा निर्धारण (Uncertainty Quantification) विधियाँ मौलिक रूप से विफल रहती हैं क्योंकि वे बाहरी तथ्यात्मक शुद्धता के बजाय केवल अनसुपरवाइज्ड क्लस्टरिंग के माध्यम से आंतरिक पीढ़ी निरंतरता को मापती हैं, जिससे सुरक्षा की एक भ्रामक भावना पैदा होती है जो आत्मविश्वासी मतिभ्रम (hallucinations) का पता नहीं लगा सकती।

Tiejin Chen, Longchao Da, Xiaoou Liu, Hua Wei2026-05-20
💬 NLP

Diagnosing Multi-step Reasoning Failures in Black-box LLMs via Stepwise Confidence Attribution

यह शोध पत्र स्टेपवाइज कॉन्फिडेंस एट्रिब्यूशन (SCA) प्रस्तुत करता है, जो ब्लैक-बॉक्स LLMs में बहु-चरणीय तर्क विफलताओं का निदान करने के लिए एक ढांचा है, जो सर्वसम्मति संरचनाओं के आधार पर चरण-स्तरीय आत्मविश्वास स्कोर असाइन करने के लिए इंफॉर्मेशन बॉटलनेक सिद्धांत को लागू करता है, जिससे पारंपरिक उत्तर-स्तर की प्रतिक्रिया की तुलना में अधिक प्रभावी आत्म-सुधार सक्षम होता है।

Xiaoou Liu, Tiejin Chen, Dengjia Zhang, Yaqing Wang, Lu Cheng, Hua Wei2026-05-20
🤖 AI

AQuaUI: Visual Token Reduction for GUI Agents with Adaptive Quadtrees

AquaUI एक ट्रेनिंग-मुक्त, इन्फरेंस-टाइम टोकन रिडक्शन विधि है जो GUI एजेंटों के लिए एडेप्टिव क्वाडट्रीज़ (adaptive quadtrees) का उपयोग करती है ताकि स्क्रीनशॉट के गैर-समान स्थानिक सूचना घनत्व (non-uniform spatial information density) का लाभ उठाया जा सके, जिससे मल्टी-स्टेप इंटरैक्शन में लगभग पूर्ण प्रदर्शन और टेम्पोरल कंसिस्टेंसी बनाए रखते हुए महत्वपूर्ण गति और टोकन में कमी प्राप्त होती है।

Yuankai Li, Tinghui Zhu, Ha Min Son, Zhe Zhao, Xin Liu, Muhao Chen2026-05-20
💬 NLP

FormalASR: End-to-End Spoken Chinese to Formal Text

यह शोधपत्र FormalASR को प्रस्तुत करता है, जो दो कॉम्पैक्ट एंड-टू-एंड मॉडल्स (0.6B और 1.7B) का एक जोड़ा है, जिन्हें नए निर्मित बड़े पैमाने के डेटासेट्स पर सीधे बोले गए चीनी भाषा को औपचारिक लिखित पाठ में ट्रांसक्राइब करने के लिए प्रशिक्षित किया गया है, जिससे त्रुटि दर में काफी कमी आती है और विलंब उत्पन्न करने वाले पोस्ट-प्रोसेसिंग LLMs की आवश्यकता समाप्त हो जाती है।

Wanyi Ning, Yinshang Guo, Haitao Qian, Jiyuan Cheng, Weiyuan Feng, Yufei Zhang2026-05-20