🔢 mathematics

Compositional Dynamics in Learning and Mechanics

यह शोध पत्र स्मूथ एडेप्टिव अरेंजमेंट्स (smooth adaptive arrangements) के ऑपेरैड (operad) का उपयोग करते हुए एक एकीकृत कंपोजिशनल फ्रेमवर्क प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि ग्रेडिएंट-आधारित लर्निंग और हैमिल्टोनियन मैकेनिक्स दोनों ही फन्क्टोरियल सिमेंटिक्स (functorial semantics) के रूप में उभरते हैं, जहाँ एक एकल "लेंस इंटरनलाइजेशन" (lens internalization) निर्माण या तो डिसिपेटिव ग्रेडिएंट डिसेंट (dissipative gradient descent) या कंजर्वेटिव वेव डायनेमिक्स (conservative wave dynamics) उत्पन्न करता है, इस पर निर्भर करते हुए कि सिस्टम केवल स्थिति को ट्रैक करता है या स्थिति और संवेग दोनों को।

David I. Spivak2026-06-30
💻 computer science

Reward-Free Code Alignment from Pretrained or Fine-Tuned LLM: Unpacking the Trade-offs for Code Generation

यह अनुभवजन्य अध्ययन कोड जनरेशन के लिए प्रीट्रेन्ड (pretrained) और इंस्ट्रक्शन-ट्यून्ड (instruction-tuned) दोनों प्रकार के एलएलएम (LLMs) पर रिवॉर्ड-फ्री अलाइनमेंट तकनीकों (DPO और BoNBoN) को लागू करने के ट्रेड-ऑफ की जांच करता है, जो यह प्रकट करता है कि जबकि प्रीट्रेन्ड मॉडल्स को अलाइन करने से बड़े सापेक्ष सुधार प्राप्त होते हैं, इंस्ट्रक्शन-ट्यून्ड मॉडल्स से शुरुआत करने पर आम तौर पर उच्च पूर्ण सटीकता बनी रहती है, भले ही वे कम लाभ या संभावित गिरावट प्रदान करते हों।

Gias Uddin, Sanjeepan Sivapiran2026-06-30
💬 NLP

BERTomelo: Your Portuguese Encoder Best Friend

यह शोध पत्र BERTomelo को प्रस्तुत करता है, जो ModernBERT आर्किटेक्चर पर निर्मित और 106-मिलियन दस्तावेज़ों के विशाल संग्रह पर प्रशिक्षित एक अगली पीढ़ी का एकलभाषी पुर्तगाली एनकोडर है, जो मौजूदा पुर्तगाली मॉडलों से बेहतर प्रदर्शन करता है और विभिन्न एनएलपी कार्यों के लिए बहुभाषी विकल्पों के मुकाबले एक अधिक कुशल विकल्प प्रदान करता है।

Rennê Ruan Alves Oliveira, Gustavo Cordeiro Galvão Van Erven, Luís Paulo Faina Garcia2026-06-30
💻 computer science

Efficient Spatio-Temporal Grounding with Multimodal Large Models via Second-Level Tracking and RL Verification

यह शोध पत्र लंबे वीडियो के लिए एक कुशल स्थानिक-कालिक ग्राउंडिंग (spatio-temporal grounding) ढांचे का प्रस्ताव करता है जो कम्प्यूटेशनल दक्षता और स्थानीयकरण सटीकता के बीच एक मजबूत संतुलन प्राप्त करने के लिए सेकंड-स्तरीय ट्रैकिंग को क्रॉस-सेकंड स्मूथिंग, चेन-ऑफ-थॉट ट्रजेक्टरी सिंथेसिस और सुदृढीकरण लर्निंग (reinforcement learning) सत्यापन के साथ जोड़ता है।

Tianshu Zhang, Yan Wang, Ji Qi, Lijie Wen2026-06-30
💬 NLP

How to Leverage Synthetic Speech for LLM-Based ASR Systems?

यह शोध पत्र यह प्रदर्शित करता है कि एक LLM-आधारित ASR आर्किटेक्चर में उन विशिष्ट परतों की पहचान करके जहाँ सिंथेटिक और वास्तविक भाषण भिन्न होते हैं, और वास्तविक दुनिया की ध्वनिक अनियमितताओं की नकल करने के लिए रूम इम्पल्स रिस्पॉन्स के साथ सिंथेटिक डेटा को संवर्धित करके, सिस्टम केवल 25% वास्तविक भाषण रिकॉर्डिंग का उपयोग करके पूर्णतः वास्तविक-डेटा बेसलाइन के बराबर या उससे बेहतर प्रदर्शन प्राप्त कर सकता है।

Yanis Labrak, Dairazalia Sanchez-Cortes, Sergio Burdisso, Séverin Baroudi, Shashi Kumar, Esaú Villatoro-Tello, Srikanth (…)2026-06-30
💬 NLP

The strength of clinical evidence is recoverable from language model representations but not from their stated grades

यद्यपि लार्ज लैंग्वेज मॉडल्स अपने आंतरिक निरूपण (इंटरनल रिप्रेजेंटेशन) के भीतर नैदानिक साक्ष्य की शक्ति का एक पुनर्प्राप्त करने योग्य संकेत समाहित करते हैं, फिर भी वे इस जानकारी को स्पष्ट रूप से बताने में लगातार विफल रहते हैं, जिससे उनके घोषित साक्ष्य ग्रेड, उस अंतर्निहित संकेत की उपस्थिति के बावजूद, अविश्वसनीय हो जाते हैं।

Soroosh Tayebi Arasteh2026-06-30
💻 computer science

Fairness Attacks on Recommender Systems

यह शोध पत्र एक नवीन संरचना-जागरूक सुदृढीकरण शिक्षण-आधारित हमला पद्धति प्रस्तावित करता है जो नकली उपयोगकर्ता प्रोफाइल उत्पन्न करने के लिए आइटम और लिंग चयन नीतियों को संयुक्त रूप से अनुकूलित करता है, जिससे लक्षित अनुशंसा प्रणालियों की अनfairness (अन्यायपूर्णता) को प्रभावी ढंग से बढ़ाया जाता है, जिसमें निष्पक्षता-जागरूक तंत्र के साथ डिज़ाइन की गई प्रणालियाँ भी शामिल हैं।

Yanan Wang, Yong Ge2026-06-30
💬 NLP

A Comparative Study on Affective Cues in Text Embeddings Across Psychological Emotion Theories

यह अध्ययन तीन मनोवैज्ञानिक भावना ढांचों के माध्यम से बारह आधुनिक टेक्स्ट एनकोडर्स का मूल्यांकन करता है, जो यह प्रकट करता है कि जहाँ निर्देश-जागरूक ओपन-वेट मॉडल शब्द-स्तरीय एम्बेडिंग में भावनात्मक जानकारी को पकड़ने में उत्कृष्ट हैं, वहीं टास्क-ट्यून्ड और प्रोप्राइटरी एनकोडर्स वाक्य-स्तरीय भावनात्मक वर्गीकरण में बेहतर प्रदर्शन करते हैं।

Fabio Ciani, Harald Schweiger, Emilia Parada-Cabaleiro, Markus Schedl2026-06-30
🤖 machine learning

Statistically Indistinguishable, Operationally Distinct: A Formal Barrier for Tabular Foundation Models

यह शोध पत्र यह प्रदर्शित करके टैबुलर फाउंडेशन मॉडल्स के लिए एक औपचारिक बाधा स्थापित करता है कि उन्नत तर्क क्षमताओं के बावजूद, वे कानूनी और नियम-उल्लंघन करने वाली डेटाबेस अवस्थाओं के बीच अंतर नहीं कर सकते हैं यदि उनके पास डेटा को नियंत्रित करने वाले परिचालन नियमों तक पहुंच नहीं है, जैसा कि उनके "ऑपरेशनल ट्यूरिंग टेस्ट" को पास करने में विफल होने से प्रमाणित होता है जहाँ केवल नियम-व्युत्पन्न ऑडिट ही पूर्ण सटीकता प्राप्त करते हैं।

Tassilo Klein, Johannes Hoffart2026-06-30
💻 computer science

Unified Complex-valued Neural Network: A Magnitude-Phase Computational Model for Event-Driven Neuromorphic Learning

यह शोध पत्र यूनिफाइड कॉम्प्लेक्स-वैल्यूड न्यूरल नेटवर्क (UCNN) को प्रस्तुत करता है, जो एक नवीन मॉडल है जो एक एसिमेट्रिक कॉम्प्लेक्स-वैल्यूड स्टेट के माध्यम से निरंतर मैग्नीट्यूड एनकोडिंग को फेज-ड्रिवन इवेंट जनरेशन के साथ एकीकृत करता है, जिससे यूनिफाइड बैकप्रोपैगेशन और न्यूरोमॉर्फिक अनुप्रयोगों के लिए एक इवेंट-ड्रिवन एडेप्टिव लर्निंग रूल के माध्यम से कुशल, स्पार्स और व्याख्या योग्य स्पैटियोटेम्पोरल लर्निंग सक्षम होती है।

Reza Ahmadvand, Sarah Safura Sharif, Yaser Mike Banad2026-06-30