🤖 AI

A Descriptive and Normative Theory of Human Beliefs in RLHF

यह शोध पत्र एक नए सैद्धांतिक ढांचे का प्रस्ताव और सत्यापन करता है जो यह प्रदर्शित करता है कि एक AI एजेंट की क्षमताओं के बारे में मानवीय विश्वास RLHF में प्राथमिकता जनरेशन (preference generation) को महत्वपूर्ण रूप से प्रभावित करते हैं, और यह दर्शाता है कि इन विश्वासों को वास्तविक एजेंट क्षमताओं के साथ संरेखित करना—इष्टतमता (optimality) मान लेने के बजाय—अधिक प्रदर्शन करने वाली सीखी गई नीतियों की ओर ले जाता है।

Sylee Dandekar, Shripad Deshmukh, Frank Chiu, W. Bradley Knox, Scott Niekum2026-07-13
🔬 materials science

Transformer-Based Inverse Microrheology for Experimental Mechanics at Ultra-High Strain Rates

यह शोध पत्र बबल डायनेमिक्स ट्रांसफॉर्मर (BDT) को प्रस्तुत करता है, जो एक AI-संवर्धित ढांचा है जो लेजर-प्रेरित कैविटेशन डेटा से सॉफ्ट मैटेरियल्स के अल्ट्रा-हाई स्ट्रेन-रेट विस्कोइलास्टिक गुणों को तेजी से और सटीक रूप से अभिलक्षणित करने के लिए भौतिकी-आधारित सिमुलेशन पर प्रशिक्षित ट्रांसफॉर्मर न्यूरल नेटवर्क का लाभ उठाता है, जो पारंपरिक पुनरावृत्ति व्युत्क्रम फिटिंग विधियों की कम्प्यूटेशनल सीमाओं को दूर करता है।

Lehu Bu, Zhaohan Yu, Danila Frolkin, Junyoung Kim, Qihang Shi, Jan N. Fuhg, Shaoting Lin, Jin Yang2026-07-13
📊 statistics

CLEAR: Calibrated Learning for Epistemic and Aleatoric Risk

यह शोध पत्र CLEAR का प्रस्ताव करता है, जो एक ऐसा अंशांकन (कैलिब्रेशन) तरीका है जो विविध वास्तविक दुनिया के डेटासेट में रिग्रेशन कार्यों के लिए प्रेडिक्टिव इंटरवल्स की कंडीशनल कवरेज और दक्षता में महत्वपूर्ण सुधार करने के लिए एलियटोरिक (aleatoric) और एपिस्टेमिक (epistemic) अनिश्चितता के लिए अलग-अलग मापदंडों को जोड़ता है।

Ilia Azizi, Juraj Bodik, Jakob Heiss, Bin Yu2026-07-13
📊 statistics

Cluster and then Embed: A Modular Approach for Visualization

यह शोध पत्र एक पारदर्शी, मॉड्यूलर विज़ुअलाइज़ेशन फ्रेमवर्क प्रस्तावित करता है जो डेटा को क्रमिक रूप से क्लस्टर करने, प्रत्येक क्लस्टर को व्यक्तिगत रूप से एम्बेड करने और फिर स्थानीय संरचना और वैश्विक ज्यामिति दोनों को संरक्षित करने के लिए उन्हें संरेखित करने के माध्यम से t-SNE और UMAP जैसी विधियों में सुधार करता है।

Elizabeth Coda, Ery Arias-Castro, Gal Mishne2026-07-13
📊 statistics

Near-optimal Delta-convex Estimation of Lipschitz Functions

यह शोध पत्र डेल्टा-कॉन्वेक्स (delta-convex) फलनों में एक गैर-रेखीय विशेषता विस्तार (nonlinear feature expansion) के माध्यम से मैक्स-एफ़िन (max-affine) विधियों का विस्तार करके, शोर वाले डेटा से लिप्सचिट्ज़ (Lipschitz) फलनों का अनुमान लगाने के लिए एक सुलभ, निकट-इष्टतम एल्गोरिदम प्रस्तुत करता है, जो अनुकूलनशील विभाजन (adaptive partitioning) और एक द्वि-चरणीय अनुकूलन प्रक्रिया के माध्यम से लिप्सचिट्ज़ स्थिरांक के पूर्व ज्ञान के बिना मिनीमैक्स अभिसरण दर (minimax convergence rates) प्राप्त करता है।

Gábor Balázs2026-07-13
⚡ electrical engineering

Robustness Evaluation of Machine Learning Models for Fault Classification and Localization In Power System Protection

यह शोध पत्र पावर सिस्टम फॉल्ट क्लासिफिकेशन और लोकलाइजेशन के लिए मशीन लर्निंग मॉडल्स की मजबूती का मूल्यांकन करने हेतु हाई-फिडेलिटी EMT सिमुलेशन का उपयोग करते हुए एक एकीकृत ढांचे को प्रस्तुत करता है, जो यह प्रकट करता है कि जबकि क्लासिफिकेशन डेटा डिग्रेडेशन के तहत काफी हद तक स्थिर रहता है, लोकलाइजेशन की सटीकता वोल्टेज माप के नुकसान के प्रति अत्यधिक संवेदनशील है।

Julian Oelhaf, Mehran Pashaei, Georg Kordowich, Christian Bergler, Andreas Maier, Johann Jäger, Siming Bayer2026-07-13
🤖 machine learning

Hair-Trigger Alignment: Black-Box Evaluation Cannot Guarantee Post-Update Alignment

यह शोध पत्र यह प्रदर्शित करता है कि स्टैटिक ब्लैक-बॉक्स मूल्यांकन अपडेट के बाद लार्ज लैंग्वेज मॉडल्स की सुरक्षा की गारंटी नहीं दे सकता है, क्योंकि ओवरपैरामीट्राइजेशन मॉडल्स को सभी मानक अलाइनमेंट परीक्षणों को पास करने की अनुमति देता है जबकि वे उन अंतर्निहित प्रतिकूल व्यवहारों को छिपाए रखते हैं जिन्हें एक एकल बेनाइन ग्रेडिएंट अपडेट द्वारा भी ट्रिगर किया जा सकता है।

Yavuz Bakman, Duygu Nur Yaldiz, Eleni Triantafillou, Peter Kairouz, Salman Avestimehr, Sai Praneeth Karimireddy2026-07-13
🤖 AI

Preference Conditioned Multi-Objective Reinforcement Learning: Decomposed, Diversity-Driven Policy Optimization

यह शोध पत्र D3POD^3PO को प्रस्तुत करता है, जो एक प्राथमिकता-सशर्त बहु-उद्देश्यीय सुदृढीकरण शिक्षण (multi-objective reinforcement learning) ढांचा है, जो एक विखंडित, विलंब-चरण भारण पाइपलाइन (decomposed, late-stage weighting pipeline) और एक विविधता नियमितकर्ता (diversity regularizer) का उपयोग करके मौजूदा विधियों की सीमाओं को दूर करता है ताकि विविध बेंचमार्क में बेहतर पारेटो फ्रंट कवरेज और उच्च-गुणवत्ता वाली नीतियां प्राप्त की जा सकें।

Tanmay Ambadkar, Sourav Panda, Shreyash Kale, Jonathan Dodge, Abhinav Verma2026-07-13
🤖 machine learning

Tensor Methods: A Unified and Interpretable Approach for Material Design

यह शोध पत्र सामग्री डिजाइन के लिए एक एकीकृत टेंसर पूर्णता (tensor completion) दृष्टिकोण प्रस्तावित करता है जो गैर-समान नमूनाकरण (non-uniform sampling) के तहत व्याख्यात्मकता और सामान्यीकरण दोनों में पारंपरिक मशीन लर्निंग सरोगेट मॉडल से बेहतर प्रदर्शन करता है, और अपने टेंसर कारकों के माध्यम से अंतर्निहित भौतिक घटनाओं को सफलतापूर्वक पुन: खोजता है।

Shaan Pakala, Aldair E. Gongora, Brian Giera, Evangelos E. Papalexakis2026-07-13
📊 statistics

Global Sequential Testing for Multi-Stream Auditing

यह शोध पत्र मल्टी-स्ट्रीम ऑडिटिंग के लिए कुशल वैश्विक अनुक्रमिक परीक्षण विधियों का प्रस्ताव करता है जो पारंपरिक बोनफेरोनी-आधारित दृष्टिकोणों की तुलना में तेज़ स्टॉपिंग समय और अधिक सांख्यिकीय शक्ति प्राप्त करने के लिए मर्जिंग मार्टिंगल्स का उपयोग करते हैं, विशेष रूप से सघन वैकल्पिक परिकल्पनाओं के तहत।

Beepul Bharti, Ambar Pal, Jeremias Sulam2026-07-13