💬 NLP

BrainSurgery: Reproducible and Reliable Declarative Weight Manipulations for Model Editing and Upcycling

BrainSurgery एक डिक्लेरेटिव (declarative), YAML-आधारित टूल है जिसे मॉडल एडिटिंग और अपसाइक्लिंग में वर्तमान एड-हॉक (ad-hoc) वर्कफ़्लो की नाजुकता को संबोधित करने के लिए न्यूरल नेटवर्क चेकपॉइंट्स हेतु सुदृढ़, पुनरुत्पादनीय (reproducible) और मान्य टेंसर हेरफेर को सक्षम करने के लिए डिज़ाइन किया गया है।

Gianluca Barmina, Annemette Broch Pirchert, Andrea Blasi Núñez, Lukas Galke Poech, Peter Schneider-Kamp2026-06-09
🤖 machine learning

Evaluating the Representation Space of Diffusion Models via Self-Supervised Principles

यह शोध पत्र इनवेरिएंट कंटैमिनेशन रेश्यो (ICR) का उपयोग करने वाले एक स्व-पर्यवेक्षित ढांचे को प्रस्तुत करता है जो डिफ्यूजन मॉडल्स का संयुक्त रूप से मूल्यांकन करता है, जिससे यह पता चलता है कि इष्टतम रिप्रजेंटेशन इनवेरिएंस (प्रतिनिधित्व अपरिवर्तनीयता) मध्यम शोर स्तरों पर होती है और प्रशिक्षण के दौरान बढ़ती अवशिष्ट ऊर्जा (रेसिडुअल एनर्जी) मेमोरीज़ेशन के शुरुआती संकेतक के रूप में कार्य करती है।

Xiao Li, Yixuan Jia, Zekai Zhang, Xiang Li, Lianghe Shi, Jinxin Zhou, Zhihui Zhu, Liyue Shen, Qing Qu2026-06-09
🤖 machine learning

Disentanglement with Holographic Reduced Representations

यह शोध पत्र होलोग्राफिक रिड्यूस्ड रिप्रेजेंटेशन्स (HRR) का उपयोग करते हुए एक अनसुपरवाइज्ड लर्निंग एल्गोरिदम प्रस्तावित करता है ताकि लेटेंट फैक्टर्स को सिम्बोलिक स्ट्रक्चर्स के रूप में मानकर न्यूरल डिसेंटैंगलमेंट प्राप्त किया जा सके, जो यह प्रदर्शित करता है कि HRR अनबाइंडिंग ऑपरेशन फैक्टर्स को अलग करने के लिए एक इंडक्टिव बायस प्रदान करता है और पारंपरिक कंटीन्यूअस ऑटोएनकोडर-आधारित विधियों की तुलना में बेहतर नॉइज़ रोबस्टनेस और थ्योरेटिकल कैपेसिटी बाउंड्स प्रदान करता है।

Jhonny J. Velasquez Olivera, Christo K. Thomas, Walid Saad2026-06-09
⚛️ quantum physics

Adaptive directional gradients for parameterised quantum circuits

यह शोध पत्र पैरामीट्राइज़्ड क्वांटम सर्किट के लिए एक फॉरवर्ड ग्रेडिएंट फ्रेमवर्क प्रस्तुत करता है जो मौजूदा ग्रेडिएंट एस्टिमेशन विधियों को एकीकृत करता है और QUIVER एडेप्टिव ऑप्टिमाइज़र को पैरामीटर-शिफ्ट नियम और अन्य अत्याधुनिक ऑप्टिमाइज़रों की तुलना में कम मेजरमेंट लागत के साथ काफी अधिक कुशल प्रशिक्षण प्राप्त करने में सक्षम बनाता है।

Brian Coyle, Snehal Raj, Virag Umathe, El Amine Cherrat, Elham Kashefi2026-06-09
🤖 AI

Multi-Turn Evaluation of Deep Research Agents Under Process-Level Feedback

यह शोध पत्र 'रिसर्च गैप इन्फरेंस' नामक एक नवीन प्रक्रिया-स्तरीय फीडबैक पद्धति का उपयोग करते हुए डीप रिसर्च एजेंटों के लिए एक मल्टी-टर्न मूल्यांकन ढांचे को प्रस्तुत करता है, जो यह प्रकट करता है कि हालांकि लक्षित फीडबैक का एक एकल दौर रिपोर्ट की गुणवत्ता में महत्वपूर्ण सुधार करता है, लेकिन आगामी टर्न (turns) लाभों को संचित करने में विफल रहते हैं क्योंकि एजेंट पहले से संतुष्ट मानदंडों पर वापस जाने लगते हैं, जो यह संकेत देता है कि विश्वसनीय मल्टी-टर्न सुधार वर्तमान आर्किटेक्चर के लिए अभी भी पहुंच से बाहर है।

Rishabh Sabharwal, Hongru Wang, Amos Storkey, Jeff Z. Pan2026-06-09
🤖 machine learning

Your Model Already Knows: Attention-Guided Safety Filter for Vision-Language-Action Models

यह शोध पत्र विजन-लैंग्वेज-एक्शन मॉडल्स के लिए एक बिना प्रशिक्षण वाले, वास्तविक समय के सुरक्षा फिल्टर को प्रस्तुत करता है जो लक्ष्यों की पहचान करने और शेष दृश्य को बाधाओं के रूप में मानने के लिए आंतरिक अटेंशन हेड्स का लाभ उठाता है, जिससे अतिरिक्त सहायक मॉडलों की आवश्यकता के बिना स्थिर और गतिशील दोनों वस्तुओं के साथ प्रभावी टक्कर बचाव सक्षम होता है।

Seongbin Park, Fan Zhang, Baharan Mirzasoleiman, Shahriar Talebi, Nader Sehatbakhsh2026-06-09
🤖 machine learning

Preserving Plasticity in Continual Learning via Dynamical Isometry

यह शोध पत्र यह स्थापित करता है कि निरंतर शिक्षण (continual learning) में प्लास्टिसिटी को बनाए रखने के लिए डायनामिकल आइसोमेट्री एक प्रमुख तंत्र है, जो लगभग-आइसोमेट्रिक स्थितियों को बनाए रखने के लिए एक नवीन नियमितीकरण योजना और AdamO ऑप्टिमाइज़र का प्रस्ताव देता है, जिससे गहरे न्यूरल नेटवर्क में सीखने की क्षमता के क्रमिक नुकसान को रोका जा सके।

Andries Rosseau, Robert Müller, Ann Nowé2026-06-09
💬 NLP

iOSWorld: A Benchmark for Personally Intelligent Phone Agents

यह शोध पत्र iOSWorld प्रस्तुत करता है, जो व्यक्तिगत रूप से बुद्धिमान फोन एजेंटों का मूल्यांकन करने के लिए 26 परस्पर जुड़े ऐप्स और एक निरंतर उपयोगकर्ता पहचान वाला पहला इंटरैक्टिव नेटिव iOS सिम्युलेटर बेंचमार्क है, जो यह प्रकट करता है कि हालांकि विशेषाधिकार प्राप्त विजन+XML एक्सेस फ्रंटियर मॉडल के प्रदर्शन को महत्वपूर्ण रूप से बढ़ाता है, फिर भी वर्तमान एजेंट जटिल मल्टी-ऐप और वैयक्तिकरण कार्यों में संघर्ष करते हैं।

Lawrence Keunho Jang, Mareks Woodside, Geronimo Carom, Andrew Keunwoo Jang, Jing Yu Koh, Ruslan Salakhutdinov2026-06-09
🤖 machine learning

Echo-Memory: A Controlled Study of Memory in Action World Models

यह शोध पत्र इको-मेमोरी (Echo-Memory) प्रस्तुत करता है, जो एक नियंत्रित अध्ययन है जो एक्शन-कंडीशन्ड वर्ल्ड मॉडल्स में मेमोरी मैकेनिज्म को अलग करता है ताकि यह प्रदर्शित किया जा सके कि रॉ कॉन्टेक्स्ट और ब्लॉक-वाइज स्टेट-स्पेस रिकरेंस, कंप्रेस्ड विकल्पों की तुलना में ओपन-डोमेन रिटर्न टास्क में बेहतर प्रदर्शन करते हैं, जो यह प्रकट करता है कि रिप्ले फिडेलिटी (replay fidelity), सच्ची वर्ल्ड कंसिस्टेंसी का एक अपर्याप्त प्रॉक्सी है।

Wayne King, Zeyue Xue, Yuxuan Bian, Jie Huang, Haoran Li, Yaowei Li, Yaofeng Su, Yuming Li, Haoyu Wang, Shiyi Zhang, Son (…)2026-06-09