💻 computer science

SafePyramid: A Hierarchical Benchmark for In-context Policy Guardrailing

यह शोध पत्र SafePyramid को प्रस्तुत करता है, जो एक पदानुक्रमित बेंचमार्क है जिसमें 1,000 बहु-चरण (multi-turn) वार्तालाप और 3,000 अनुप्रयोग-विशिष्ट नीतियां शामिल हैं, जो इन-कॉन्टेक्स्ट पॉलिसी गार्डरेलिंगिंग का मूल्यांकन करता है, और यह प्रकट करता है कि अत्याधुनिक मॉडल भी जटिलता के विभिन्न स्तरों के माध्यम से सुरक्षा उल्लंघनों को सटीक रूप से पहचानने और नवीन नीति ढांचों के अनुकूल होने में संघर्ष करते हैं।

Jiacheng Zhang, Haoyu He, Sen Zhang, Shen Wang, Xiaolei Xu, Yuhao Sun, Meng Shen, Feng Liu2026-06-30
💻 computer science

Trust Your Instincts: Confidence-Driven Test-Time RL for Vision-Language-Action Models

यह शोध पत्र T²VLA को प्रस्तुत करता है, जो एक टेस्ट-टाइम सुदृढीकरण लर्निंग (reinforcement learning) फ्रेमवर्क है जो विज़न-लैंग्वेज-एक्शन मॉडल्स को आंतरिक आत्मविश्वास संकेतों और एक ड्यूल-एक्सपर्ट बूटस्ट्रैपिंग तंत्र का लाभ उठाकर स्व-बूटस्ट्रैपिंग पॉलिसी सुधार प्राप्त करने में सक्षम बनाता है, जिससे बाहरी पर्यावरणीय पुरस्कारों की आवश्यकता समाप्त हो जाती है।

Siyao Chen, Jiakang Yuan, Jiaxin Wang, Tao Chen2026-06-30
⚡ electrical engineering

Child-Centric Voice Anonymization in Single and Multi-Speaker Speech via Domain-Adapted SSL Models

यह शोधपत्र डोमेन-अनुकूलित स्व-पर्यवेक्षित शिक्षण मॉडलों का उपयोग करते हुए एक बाल-केंद्रित वॉयस एनोनिमाइजेशन फ्रेमवर्क का प्रस्ताव करता है जो सिंगल-स्पीकर और मल्टी-स्पीकर दोनों परिदृश्यों में मजबूत गोपनीयता सुरक्षा सुनिश्चित करते हुए स्पीच इंटेलिजिबिलिटी और गुणवत्ता को प्रभावी ढंग से संरक्षित करता है।

Pranav Tushar, Xiao Xiao Miao, Rong Tong2026-06-30
💻 computer science

Critical Interval MSE: Toward Reliable Offline Validation for Robot Manipulation Policies

यह शोध पत्र क्रिटिकल इंटरवल MSE (CI-MSE) प्रस्तुत करता है, जो एक सुदृढ़ ऑफलाइन वैलिडेशन मेट्रिक है जो त्रुटि गणना को कार्य-महत्वपूर्ण खंडों तक सीमित करता है और वास्तविक दुनिया के रोबोटिक मैनिपुलेशन प्रदर्शन के साथ काफी मजबूत सहसंबंध प्राप्त करने के लिए एक्शन-अलाइनमेंट प्रक्रियाओं को शामिल करता है, जो मानक रॉ MSE की तुलना में बेहतर है।

Haoxu Huang, Tongsam Zheng, Yifan Chen, Jiacheng You, Yang Gao2026-06-30
⚡ electrical engineering

Semi-Supervised Sound Event Detection with Conditional Mixup and Embedding-Level Contrastive Loss

यह शोध पत्र एक अर्ध-पर्यवेक्षित (semi-supervised) साउंड इवेंट डिटेक्शन फ्रेमवर्क प्रस्तावित करता है जो प्रचुर मात्रा में उपलब्ध अनलेबल डेटा का प्रभावी ढंग से लाभ उठाने के लिए कंडीशनल मिक्सअप को एम्बेडिंग-लेवल कंट्रास्टिव लॉस के साथ एकीकृत करता है, जिससे DESED डेटासेट पर अत्याधुनिक (state-of-the-art) प्रदर्शन प्राप्त होता है।

Nian Shao, Xian Li, Xiaofei Li2026-06-30
🤖 machine learning

CW-B: Class Weighted Boosting Framework for Imbalance Resilient Multi Class Cardiac Phenotyping

यह शोध पत्र CW-B को प्रस्तुत करता है, जो एक क्लास-वेटेड XGBoost फ्रेमवर्क है जो नैदानिक व्याख्यात्मकता बनाए रखते हुए पांच-वर्ग हृदय डिस्चार्ज फेनोटाइपिंग में बेहतर प्रदर्शन प्राप्त करने के लिए वास्तविक दुनिया के डेटा असंतुलन और अनुपलब्धता को प्रभावी ढंग से संबोधित करता है।

Sijia Li, Xiaoyu Tan, Chen Zhan, Yuanji Ma, Haoyu Wang, Xihe Qiu2026-06-30
💻 computer science

Pondering the Way: Spatial-perceiving World Action Model for Embodied Navigation

यह शोध पत्र SWAM का प्रस्ताव करता है, जो एक कार्य-केंद्रित विश्व क्रिया मॉडल (task-centric world action model) है जो एकल-पास अनुमान (single-pass inference) के माध्यम से मोनोकुलर RGB इनपुट से लक्ष्य-संगत RGB-D अनुक्रमों और क्रिया प्रक्षेपवक्रों (action trajectories) को एक साथ उत्पन्न करता है, जो नेविगेशन दक्षता, सटीकता और सामान्यीकरण में मौजूदा सत्यापन-केंद्रित योजनाकारों (verification-centric planners) से काफी बेहतर प्रदर्शन करता है।

Hong Chen, Daqi Liu, Zehan Zhang, Haiguang Wang, Tianhao Lu, Longfei Yan, Haiyang Sun, Fangzhen Li, Hongwei Xie, Bing Wa (…)2026-06-30
🤖 machine learning

Exploiting Local Flatness for Efficient Out-of-Distribution Detection

यह शोध पत्र Fold को प्रस्तुत करता है, जो एक हल्का आउट-ऑफ-डिस्ट्रीब्यूशन (OOD) डिटेक्टर है जो इस अवलोकन का लाभ उठाता है कि इन-डिस्ट्रीब्यूशन डेटा की तुलना में OOD इनपुट अधिक हेसियन कर्वेचर (Hessian curvature) प्रदर्शित करते हैं, और न्यूनतम कम्प्यूटेशनल ओवरहेड के साथ अत्याधुनिक प्रदर्शन प्राप्त करने के लिए फीचर हेसियन और आंशिक सामान्यीकरण (partial normalization) का उपयोग करता है।

Seonghwan Park, Hyunji Jung, Dongyeop Lee, Namhoon Lee2026-06-30
💻 computer science

SWE-Together: Evaluating Coding Agents in Interactive User Sessions

यह शोध पत्र SWE-Together प्रस्तुत करता है, जो वास्तविक उपयोगकर्ता-एजेंट कोडिंग सत्रों से प्राप्त एक मल्टी-टर्न बेंचमार्क है, जो रिपॉजिटरी की अंतिम शुद्धता और आवश्यक सुधारात्मक फीडबैक टर्न की संख्या दोनों के आधार पर कोडिंग एजेंटों का मूल्यांकन करने के लिए एक रिएक्टिव LLM-आधारित उपयोगकर्ता सिम्युलेटर का उपयोग करता है, जिससे यह पता चलता है कि अधिक शक्तिशाली एजेंट कम हस्तक्षेपों के साथ उच्च सफलता दर प्राप्त करते हैं।

Yifan Wu, Zhuokai Zhao, Songlin Li, Ho Hin Lee, Jiacheng Zhu, Shirley Wu, Tianhe Yu, Serena Li, Lizhu Zhang, Xiangjun Fa (…)2026-06-30
🤖 machine learning

DuoMem: Towards Capable On-Device Memory Agents via Dual-Space Distillation

यह शोध पत्र DuoMem को प्रस्तुत करता है, जो एक द्वैत-स्थान डिस्टिलेशन (dual-space distillation) ढांचा है जो संदर्भ-स्थान मेमोरी संवर्धन (context-space memory augmentation) और पैरामीटर-स्थान फाइन-ट्यूनिंग (parameter-space fine-tuning) को संयोजित करता है ताकि कॉम्पैक्ट ऑन-डिवाइस LLMs को जटिल प्रक्रियात्मक कार्यों में शिक्षक-स्तर के प्रदर्शन को प्राप्त करने में सक्षम बनाया जा सके, जबकि विलंबता (latency) और संसाधनों की आवश्यकताओं को महत्वपूर्ण रूप से कम किया जा सके।

Peyman Hosseini, Ondrej Bohdal, Ahmed Alajrami, Andrea Maracani, Ignacio Castro, Matthew Purver, Mete Ozay, Savas Ozkan (…)2026-06-30