💻 computer science

kkNNProxy: Efficient Training-Free Proxy Alignment for Black-Box Zero-Shot LLM-Generated Text Detection

यह शोध पत्र kkNNProxy का प्रस्ताव करता है, जो एक प्रशिक्षण-मुक्त (training-free) और क्वेरी-कुशल (query-efficient) ढांचा है जो एक हल्के डेटास्टोर पर kk-निकटतम पड़ोसी (k-nearest neighbor) रिट्रीवल तंत्र के माध्यम से एक निश्चित प्रॉक्सी LLM को अज्ञात स्रोत मॉडलों के साथ संरेखित करता है, जिससे फाइन-ट्यूनिंग या बार-बार API इंटरैक्शन की आवश्यकता के बिना LLM-जनित टेक्स्ट का सुदृढ़ ज़ीरो-शॉट डिटेक्शन सक्षम होता है।

Kahim Wong, Kemou Li, Haiwei Wu, Jiantao Zhou2026-04-03
⚡ electrical engineering

Tracking the emergence of linguistic structure in self-supervised models learning from speech

यह शोध पत्र डच पर प्रशिक्षित स्व-पर्यवेक्षित भाषण मॉडलों (self-supervised speech models) में भाषाई संरचना के उद्भव की जांच करता है, जो यह प्रकट करता है कि विभिन्न भाषाई स्तर ध्वनिक संकेतों (acoustic signals) से अपनी अमूर्तता और उपयोग किए गए विशिष्ट प्री-ट्रेनिंग उद्देश्यों से प्रभावित अलग-अलग परतवार पैटर्न और सीखने के प्रक्षेपवक्र (learning trajectories) प्रदर्शित करते हैं।

Marianne de Heer Kloots, Martijn Bentum, Hosein Mohebbi, Charlotte Pouw, Gaofei Shen, Willem Zuidema2026-04-03
💻 computer science

BidirLM: From Text to Omnimodal Bidirectional Encoders by Adapting and Composing Causal LLMs

यह शोध पत्र BidirLM को प्रस्तुत करता है, जो उच्च-प्रदर्शन वाले द्विदिशीय एनकोडर्स (bidirectional encoders) का एक परिवार है, जिसे एक नवीन प्रायर मास्किंग चरण (prior masking phase), कैटास्ट्रोफिक फॉरगेटिंग (catastrophic forgetting) को रोकने के लिए लीनियर वेट मर्जिंग और डेटा मिक्सचर की एक दोहरी रणनीति, और मल्टीमॉडल क्षमताओं को निर्बाध रूप से एकीकृत करने के लिए विशिष्ट कॉज़ल मॉडल्स के साथ संयोजन के माध्यम से कॉज़ल LLMs को व्यवस्थित रूप से अनुकूलित करके बनाया गया है।

Nicolas Boizard, Théo Deschamps-Berger, Hippolyte Gisserot-Boukhlef, Céline Hudelot, Pierre Colombo2026-04-03
💻 computer science

Goose: Anisotropic Speculation Trees for Training-Free Speculative Decoding

GOOSE एक प्रशिक्षण-मुक्त (training-free) स्पेक्युलेटिव डिकोडिंग फ्रेमवर्क है जो संदर्भ-मैच किए गए n-ग्राम टोकन और सांख्यिकीय भविष्यवाणियों के बीच के महत्वपूर्ण गुणवत्ता अंतर का लाभ उठाने के लिए एनिसोट्रोपिक (anisotropic), अनुकूली स्पाइन ट्री (adaptive spine trees) का निर्माण करता है, जो संतुलित वृक्ष संरचनाओं के बजाय उच्च-स्वीकृति वाले टोकन की गहरी श्रृंखलाओं को प्राथमिकता देकर विभिन्न लार्ज लैंग्वेज मॉडल्स पर 1.9–4.3x लॉसलेस स्पीडअप प्राप्त करता है।

Tao Jin, Phuong Minh Nguyen, Naoya Inoue2026-04-03
🤖 machine learning

Ouroboros: Dynamic Weight Generation for Recursive Transformers via Input-Conditioned LoRA Modulation

ऊरोबोरोस (Ouroboros) रिकर्सिव ट्रांसफॉर्मर्स के लिए एक गतिशील वेट जनरेशन सिस्टम पेश करता है जो प्रत्येक रिकरेंस स्टेप पर फ्रोजन लोरा (LoRA) बेस को मॉड्युलेट करने के लिए एक इनपुट-कंडीशन्ड कंट्रोलर हाइपरनेटवर्क का उपयोग करता है, जो प्रशिक्षण हानि (training loss) को काफी कम करता है और संकुचित आर्किटेक्चर में प्रदर्शन के अंतर को पुनः प्राप्त करता है, जबकि गेटेड रिकरेंस की महत्वपूर्ण भूमिका और होल्ड-आउट डेटा पर सामान्यीकरण की वर्तमान सीमाओं को भी उजागर करता है।

Jaber Jaber, Osama Jaber2026-04-03
⚡ electrical engineering

Prosodic ABX: A Language-Agnostic Method for Measuring Prosodic Contrast in Speech Representations

यह शोध पत्र "प्रोसोडिक ABX" प्रस्तुत करता है, जो स्व-पर्यवेक्षित भाषण मॉडलों (self-supervised speech models) में प्रोसोडिक कंट्रास्ट के मूल्यांकन के लिए एक भाषा-अज्ञेय (language-agnostic), लेबल-मुक्त विधि है, जिसे एक नए जारी किए गए डेटासेट का उपयोग करके अंग्रेजी, जापानी और मैंडरिन में मान्य किया गया है और यह दिखाया गया है कि यह कम-संसाधन वाली सेटिंग्स के लिए उपयुक्त सुसंगत मॉडल रैंकिंग प्रदान करता है।

Haitong Sun, Stephen McIntosh, Kwanghee Choi, Eunjung Yeo, Daisuke Saito, Nobuaki Minematsu2026-04-03
💻 computer science

Reliable Control-Point Selection for Steering Reasoning in Large Language Models

यह शोधपत्र एक विश्वसनीयता-संचालित पद्धति प्रस्तुत करता है जो स्थिरता फ़िल्टरिंग और सामग्री-उपस्थान प्रक्षेपण (content-subspace projection) का उपयोग करके कीवर्ड-लक्षित तर्क सीमाओं की उच्च अस्थिरता को दूर करते हुए बड़े भाषा मॉडलों को निर्देशित करती है, जिससे MATH-500 पर अत्याधुनिक प्रदर्शन प्राप्त होता है और मजबूत क्रॉस-मॉडल हस्तांतरणीयता प्रदर्शित होती है।

Haomin Zhuang, Hojun Yoo, Xiaonan Luo, Kehan Guo, Xiangliang Zhang2026-04-03
💻 computer science

MTI: A Behavior-Based Temperament Profiling System for AI Agents

यह शोध पत्र मॉडल टेम्परामेंट इंडेक्स (MTI) को प्रस्तुत करता है, जो फोर शेल मॉडल पर आधारित एक व्यवहार-आधारित प्रोफाइलिंग प्रणाली है, जो एआई एजेंट के स्वभाव को चार स्वतंत्र अक्षों—रिएक्टिविटी (प्रतिक्रियाशीलता), कंप्लायंस (अनुपालन), सोशियलिटी (सामाजिकता) और रेजिलिएंस (लचीलापन)—के माध्यम से मापता है ताकि यह प्रदर्शित किया जा सके कि व्यवहार संबंधी प्रवृत्तियाँ क्षमता से भिन्न होती हैं, मॉडल के आकार से स्वतंत्र रूप से भिन्न होती हैं, और आरएलएचएफ (RLHF) संरेखण द्वारा मौलिक रूप से पुनर्गठित होती हैं।

Jihoon Jeong2026-04-03
💻 computer science

Brief Is Better: Non-Monotonic Chain-of-Thought Budget Effects in Function-Calling Language Agents

यह शोध पत्र प्रकट करता है कि फंक्शन-कॉलिंग लैंग्वेज एजेंट्स में, संक्षिप्त चेन-ऑफ-थॉट रीजनिंग (लगभग 32 टोकन) एक प्रभावी फंक्शन-रूटिंग तंत्र के रूप में कार्य करके सटीकता को महत्वपूर्ण रूप से बढ़ाती है, जबकि विस्तृत रीजनिंग बढ़ते हुए मतिभ्रम (hallucinations) के माध्यम से प्रदर्शन को कम कर देती है, जिससे एक संरचित "फंक्शन-रूटिंग कोट" (Function-Routing CoT) पद्धति का प्रस्ताव मिलता है जो व्यापक बजट ट्यूनिंग के बिना विश्वसनीयता की गारंटी देता है।

Xuan Qi2026-04-03
🔭 astrophysics

AstroConcepts: A Large-Scale Multi-Label Classification Corpus for Astrophysics

यह शोध पत्र एस्ट्रोकॉन्सेप्ट्स (AstroConcepts) को प्रस्तुत करता है, जो अत्यधिक क्लास इम्बैलेंस (extreme class imbalance) को संबोधित करने के लिए यूनिफाइड एस्ट्रोनॉमी थीसॉरस (Unified Astronomy Thesaurus) से लेबल किए गए 2,367 अवधारणाओं वाले खगोल भौतिकी (astrophysics) के सारांशों का एक बड़े पैमाने पर कॉर्पस है, साथ ही यह उन बेसलाइनों को स्थापित करता है जो शब्दावली-प्रतिबंधित (vocabulary-constrained) एलएलएम (LLMs) की क्षमता और वैज्ञानिक मल्टी-लेबल वर्गीकरण के लिए फ्रीक्वेंसी-स्ट्रैटिफाइड मूल्यांकन (frequency-stratified evaluation) की आवश्यकता को प्रकट करते हैं।

Atilla Kaan Alkan, Felix Grezes, Sergi Blanco-Cuaresma, Jennifer Lynn Bartlett, Daniel Chivvis, Anna Kelbert, Kelly Lock (…)2026-04-03