💬 NLP

After the Euclidean Highway: Hyperbolic Expert AI as the Next Innovation

यह शोध पत्र HySAT को प्रस्तुत करता है, जो एक नवीन प्रशिक्षण ढांचा है जो हाइपरबोलिक कर्वेचर (hyperbolic curvature) को ट्रेन करने योग्य एडेप्टर के भीतर के बजाय विशेष रूप से लॉस लेयर (loss layer) पर लागू करके हाइपरबोलिक एक्सपर्ट एआई को स्थिर करता है, जिससे विशेषज्ञ डोमेन में पैरेंट-चाइल्ड ट्री संरचनाओं को संरक्षित किया जाता है और कई छोटे लैंग्वेज मॉडल्स में ट्रेनिंग कोलैप्स को रोका जाता है।

Kwan Soo Shin, In Seok Kang, Munho Lee2026-07-21
💬 NLP

Token-Level Off-Policy Learning for Faithful Generation Under Distribution Shift

यह शोध पत्र टोकन-लेवल ऑफ-पॉलिसी लेबलिंग (TOPL) का प्रस्ताव करता है, जो एक प्रशिक्षण प्रतिमान (पैराडाइम) है जो पोस्ट-ट्रेनिंग को टोकन-स्तरीय शुद्धता भविष्यवाणी कार्य के रूप में पुनर्गठित करता है ताकि सारांशीकरण और मशीन अनुवाद जैसे निष्ठावान जनरेशन कार्यों में मजबूत आउट-ऑफ-डिस्ट्रीब्यूशन सामान्यीकरण और व्याख्या योग्य मॉडल अपडेट प्राप्त किया जा सके।

Zitong Huang, Gustavo Lucas Carvalho, Deqing Fu, Robin Jia2026-07-21
🤖 machine learning

FailureAtlas: A Taxonomy of Failure Modes in Multi-Provider LLM Serving Infrastructure

यह शोधपत्र FailureAtlas प्रस्तुत करता है, जो मूल परत (origin layer) और पता लगाने की क्षमता (detectability) के आधार पर मल्टी-प्रदाता LLM सर्विंग गेटवे में विफलता मोड को वर्गीकृत करने वाला एक द्वि-अक्षीय वर्गीकरण (two-axis taxonomy) है, जो यह प्रकट करता है कि सबसे परिचालन रूप से गंभीर मुद्दे वे "मौन" (silent) विफलताएं हैं जो सफल HTTP प्रतिक्रियाएं लौटाते हुए भी एप्लिकेशन की स्थिति (application state) को दूषित कर देते हैं।

Vishal Pandey, Gopal Singh2026-07-21
🤖 AI

The Curvature Shadow: An Apparent Failure of Maximum-Entropy Equilibrium Selection is a Removable Artifact

यह शोध पत्र यह प्रदर्शित करता है कि कुह्न पोकर (Kuhn poker) में रेगुलराइज्ड नैश डायनेमिक्स (Regularized Nash Dynamics) और अधिकतम-एन्ट्रॉपी संतुलन (maximum-entropy equilibrium) के बीच का स्पष्ट विसंगति कोई वास्तविक चयन पूर्वाग्रह नहीं है, बल्कि एक हटाने योग्य आर्टिफैक्ट (artifact) है जो एंट्रॉपी लैंडस्केप की वक्रता के साथ परस्पर क्रिया करने वाली एक छोटी एंट्रॉपी कमी के कारण उत्पन्न हुआ है, जिसे कई खेलों में मात्रात्मक रूप से मान्य किया गया है।

Luis Leal2026-07-21
🤖 AI

COLIP-2: Olfaction-Vision-Language Embeddings

यह शोध पत्र COLIP-2 को प्रस्तुत करता है, जो एक मल्टीमॉडल एम्बेडिंग मॉडल है जो घ्राण (सूंघने की शक्ति), दृष्टि और भाषा को एकीकृत करता है ताकि रोबोट्स को वस्तुओं के स्थान पर गंध का संभाव्य रूप से पता लगाने में सक्षम बनाया जा सके, साथ ही यह ओपन-सोर्स डेटा की वर्तमान सीमाओं और घ्राण संबंधी धारणा को आगे बढ़ाने के लिए नए डेटासेट्स की आवश्यकता पर प्रकाश डालता है।

Kordel Kade France2026-07-21
🤖 AI

ZifaMem: Structured Memory for Persona, Preference, and Emotional Continuity in AI Companions

ZifaMem एक ओपन-सोर्स स्ट्रक्चर्ड मेमोरी सिस्टम है जो AI साथियों के लिए संवाद को सत्र सारांश (session summaries), एपिसोडिक यादों (episodic memories) और एक समेकित उपयोगकर्ता मॉडल (consolidated user model) में व्यवस्थित करता है, जो रॉ-हिस्ट्री बेसलाइन की तुलना में भावनात्मक निरंतरता और पर्सोना ग्राउंडिंग में महत्वपूर्ण सुधार करता है और अन्य अग्रणी मेमोरी सिस्टम के सांख्यिकीय समतुल्यता (statistical equivalence) को प्रदर्शित करता है।

Jingzhe Fang, Guozhi Xu, Yunfan Cui, Xiaochen Yang, Zhangyu Hua2026-07-21
🤖 machine learning

CoCurve: Cross-Module Co-Pruning Curvature for Training-Free Structured LLM Pruning

CoCurve एक प्रशिक्षण-मुक्त (training-free) स्ट्रक्चर्ड प्रूनिंग विधि है जो LLMs के लिए अटेंशन और FFN यूनिट्स को हटाने के लिए संयुक्त रूप से अनुकूलित करती है, जो फिशर मैट्रिक्स (Fisher matrix) के माध्यम से क्रॉस-मॉड्यूल निर्भरताओं को कैप्चर करने के लिए सेकंड-ऑर्डर टेलर एक्सपेंशन का लाभ उठाती है, जिससे बिना फाइन-ट्यूनिंग के सिंगल-शॉट क्वाड्रेटिक प्रोग्राम के माध्यम से कुशल, लेबल-मुक्त संपीड़न (label-free compression) सक्षम होता है।

Zhiren Gong, Zihao Zeng, Zijie Wang, Tiantong Wang, Chau Yuen, Wei Yang Bryan Lim2026-07-21
🤖 machine learning

A Weisfeiler-Leman Characterization of Global-Attention Graph Transformers for Mixed-Integer Linear Programs

यह शोध पत्र प्रदर्शित करता है कि मिक्सड-इंटीजर लीनियर प्रोग्राम्स (Mixed-Integer Linear Programs) के लिए ग्लोबल-अटेंशन ग्राफ फाउंडेशन मॉडल्स का एक विस्तृत वर्ग मौलिक रूप से 1-डायमेंशनल वेइसफिलेर-लेमन (Weisfeiler-Leman) टेस्ट की अभिव्यंजक शक्ति तक सीमित है, जिसका अर्थ है कि वे अपनी आर्किटेक्चरल जटिलता या पैरामीटर सेटिंग्स के बावजूद 1-WL-तुल्य गैर-आइसोमोर्फिक इंस्टेंसों के बीच अंतर नहीं कर सकते हैं।

Md Abrar Jahin, Craig A. Knoblock, Jay Pujara2026-07-21
⚡ electrical engineering

AGG: Jacobian-Aggregated Group Gradient for Efficient GRPO Training of Diffusion Models

यह शोध पत्र JAGG (Jacobian-Aggregated Group Gradient) प्रस्तुत करता है, जो डिफ्यूजन मॉडल प्रक्षेपवक्रों (trajectories) के लगभग रैखिक परिवर्तन का लाभ उठाकर मध्यवर्ती जैकोबियन (intermediate Jacobians) को अनुमानित करने और ग्रुप ग्रेडिएंट्स को एकत्रित करने के लिए है, जिससे बिना किसी महत्वपूर्ण गुणवत्ता हानि के डिफ्यूजन ट्रांसफॉर्मर्स के लिए ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइजेशन (GRPO) प्रशिक्षण की कम्प्यूटेशनल लागत को लगभग 2×\times कम किया जा सकता है।

Ruiyi Ding, Jie Li, He Kang, Ziyan Liu, Chengru Song, Yuan chen2026-07-21
🤖 machine learning

ANNLib: A Development Framework for Efficient Approximate Nearest Neighbor Search

यह शोध पत्र ANNLib को प्रस्तुत करता है, जो एक मॉड्यूलर डेवलपमेंट फ्रेमवर्क है जो एल्गोरिदम और डेटा स्ट्रक्चर घटकों को अलग करता है और उन्हें अनुकूलित करता है ताकि न्यूनतम प्रोग्रामिंग प्रयास के साथ कुशल, लचीला और उच्च-प्रदर्शन वाला एप्रोक्सिमेट नियरएस्ट नेबर सर्च सक्षम किया जा सके।

Zheqi Shen, Jingbo Su, Zijin Wan, Yan Gu, Yihan Sun2026-07-21