💬 NLP

Endogenous Resistance to Activation Steering in Language Models

यह शोध पत्र एंडोजेनस स्टीयरिंग रेजिस्टेंस (ESR) को प्रस्तुत करता है, जो एक ऐसी घटना है जहाँ लार्ज लैंग्वेज मॉडल्स विशिष्ट लेटेंट फीचर्स की पहचान करके टास्क-मिसअलाइन्ड एक्टिवेशन स्टीयरिंग का स्वायत्त रूप से पता लगाते हैं और मौखिक रूप से उसे अस्वीकार करते हैं, एक ऐसी क्षमता जिसे फाइन-ट्यूनिंग के माध्यम से बढ़ाया जा सकता है लेकिन यह मॉडल सुरक्षा और लाभकारी स्टीयरिंग हस्तक्षेपों की विश्वसनीयता, दोनों के लिए दोहरे निहितार्थ प्रस्तुत करती है।

Alex McKenzie, Keenan Pepper, Stijn Servaes, Martin Leitgab, Murat Cubuktepe, Mike Vaiana, Diogo de Lucena, Judd Rosenbl (…)2026-06-08
🤖 AI

TokaMind: A Multi-Modal Transformer Foundation Model for Tokamak Plasma Dynamics

यह शोध पत्र टोकामाइंड (TokaMind) को प्रस्तुत करता है, जो विषम MAST टोकामक डेटा पर प्रीट्रेन किया गया पहला ओपन-सोर्स मल्टी-मोडल ट्रांसफॉर्मर फाउंडेशन मॉडल है, जो 14 विविध प्लाज्मा डायनेमिक्स कार्यों में अत्याधुनिक बेसलाइनों की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है।

Tobia Boschi, Andrea Loreti, Nicola C. Amorisco, Rodrigo H. Ordonez-Hurtado, Cécile Rousseau, George K. Holt, Eszter Szé (…)2026-06-08
🔬 materials science

Multi-objective optimization and quantum hybridization of equivariant deep learning interatomic potentials

यह शोध पत्र यह प्रदर्शित करता है कि मल्टी-ऑब्जेक्टिव हाइपरपैरामीटर ऑप्टिमाइज़ेशन को लागू करने और एलीग्रो (Allegro) इंटरएटोमिक पोटेंशियल मॉडल में क्वांटम-क्लासिकल हाइब्रिड लेयर्स को पेश करने से बल भविष्यवाणी की सटीकता में महत्वपूर्ण वृद्धि होती है, विशेष रूप से कॉपर-लिथियम संरचनाओं पर, जो मशीन लर्निंग इंटरएटोमिक पोटेंशियल को बेहतर बनाने के लिए क्वांटम-क्लासिकल हाइब्रिडाइजेशन को एक आशाजनक दिशा के रूप में स्थापित करता है।

G. Laskaris, D. Morozov, D. Tarpanov, A. Seth, J. Procelewska, G. Sai Gautam, A. Sagingalieva, R. Brasher, A. Melnikov2026-06-08
🤖 machine learning

Adaptive Pluralistic Alignment: A pipeline for dynamic artificial democracy

यह शोध पत्र एडेप्टिव प्लुरलिस्टिक अलाइनमेंट (APA) प्रस्तुत करता है, जो एक मॉड्यूलर और कुशल पाइपलाइन है जो संक्षिप्त व्यक्तिगत रिवॉर्ड मॉडल सीखकर और सोशल-चॉइस-थ्योरेटिक वोटिंग का उपयोग करके विकसित होते सामाजिक मूल्यों का अनुसरण करने के लिए AI सिस्टम को अपडेट करती है, जिससे महंगी रिट्रेनिंग की आवश्यकता के बिना वैल्यू लॉक-इन से बचा जा सकता है।

Rachel Freedman2026-06-08✓ Author reviewed
⚡ electrical engineering

Which Anatomy Matters Under Limited Labels? A Data-Efficient Anatomy-Aware Benchmark for Cardiac Pathology Prediction

यह शोध पत्र यह प्रदर्शित करता है कि कार्डिएक पैथोलॉजी भविष्यवाणी के लिए सीमित लेबल सेटिंग्स के तहत, प्रदर्शन के लिए मॉडल की जटिलता बढ़ाने की तुलना में नैदानिक रूप से सार्थक शारीरिक (एनाटॉमिकल) निरूपणों की गुणवत्ता अधिक महत्वपूर्ण है, जो यह सुझाव देता है कि संसाधन-बाधित स्वास्थ्य सेवा परिदृश्यों में सूचनात्मक शरीर रचना की पहचान करना ही मुख्य कुंजी है।

Himanshu Singh2026-06-08
🤖 AI

Detecting and Mitigating Bias by Treating Fairness as a Symmetry Operation

यह शोध पत्र एक गणनात्मक रूप से हल्का ढांचा प्रस्तावित करता है जो निष्पक्षता को एक समरूपता संचालन (symmetry operation) के रूप में औपचारिक रूप देता है, जिसमें प्रतितथ्यात्मक संवेदनशील विशेषता परिवर्तनों के तहत अपरिवर्तनीयता को बहाल करने के लिए हानि-आधारित नियमितीकरण (loss-based regularization) का उपयोग किया जाता है, जिससे बिना किसी कारण ग्राफ ज्ञान की आवश्यकता के न्यूनतम सटीकता हानि के साथ महत्वपूर्ण पूर्वाग्रह कमी प्राप्त की जाती है।

Nishit Singh2026-06-08
💻 computer science

P-Cast Precision in FP8 Attention: Sink-Induced Collapse and the Optimality of S=2^8

यह शोध पत्र 'अटेंशन सिंक' (Attention Sink) घटना के कारण होने वाले FP8 अटेंशन प्रिसिजन लॉस का विश्लेषण करता है, यह प्रदर्शित करते हुए कि रिवर्स KV इटरेशन और S=256S=256 का एक स्टैटिक स्केलिंग फैक्टर प्रभावी रूप से प्रोबेबिलिटी अंडरफ्लो को रोकता है और क्वांटाइजेशन एरर को न्यूनतम करता है, जिससे फ्लैशअटेंशन-3/4 (FlashAttention-3/4) में किए गए इंजीनियरिंग विकल्पों की व्याख्या होती है और प्रिसिजन लॉस का पूर्वानुमान लगाने के लिए एक क्लोज्ड-फॉर्म थ्रेशोल्ड प्राप्त होता है।

Reed Lau2026-06-08
🤖 AI

Lean4Agent: Formal Modeling and Verification for Agent Workflow and Trajectory

यह शोध पत्र **Lean4Agent** को प्रस्तुत करता है, जो पहला ऐसा फ्रेमवर्क है जो एजेंट वर्कफ़्लो को मॉडल, सत्यापित और पुनरावृत्ति रूप से परिष्कृत करने के लिए डिपेंडेंट-टाइप औपचारिक भाषा Lean4 का लाभ उठाता है, यह प्रदर्शित करते हुए कि औपचारिक रूप से सत्यापित प्रक्षेपवक्र (trajectories) जटिल कार्यों पर लार्ज लैंग्वेज मॉडल्स के प्रदर्शन और विश्वसनीयता में महत्वपूर्ण सुधार करते हैं।

Ruida Wang, Jerry Huang, Pengcheng Wang, Xuanqing Liu, Luyang Kong, Tong Zhang2026-06-08
🤖 AI

CrowdMath: A Dataset of Crowdsourced Mathematical Research Discussions

यह शोध पत्र क्राउडमैथ (CrowdMath) का परिचय देता है, जो एमआईटी प्राइम्स-एओपीएस (MIT PRIMES–AoPS) कार्यक्रम से 164 विशेषज्ञ-एनोटेटेड सहयोगात्मक अनुसंधान चर्चाओं का एक डेटासेट है, जो गतिशील गणितीय प्रगति को समझने के लिए लार्ज लैंग्वेज मॉडल्स का बेंचमार्क करता है और यह प्रकट करता है कि हालांकि मॉडल स्थानीय चर्चा प्रवाह का अनुसरण कर सकते हैं, वे ओपन-प्रॉब्लम सॉल्विंग में व्यक्तिगत योगदान के कार्यात्मक महत्व को पहचानने में संघर्ष करते हैं।

Sherin Muckatira, Jesse Geneson, Slava Gerovitch, Pavel Etingof, Mikhail Gronas, Anna Rumshisky2026-06-08