🤖 AI

Coordinating Multiple Conditions for Trajectory-Controlled Human Motion Generation

यह शोध पत्र CMC का प्रस्ताव करता है, जो एक डिकपल्ड टू-स्टेज फ्रेमवर्क है जो मानव गति निर्माण के लिए टेक्स्ट और ट्रैजेक्टरी स्थितियों को समन्वित करता है, जो पहले एक सरलीकृत प्रतिनिधित्व के माध्यम से सटीक ट्रैजेक्टरी अनुवर्ती सुनिश्चित करता है और फिर स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त करने के लिए एक सिलेक्टिव इनपेंटिंग मैकेनिज्म द्वारा उन्नत टेक्स्ट-कंडीशन्ड इनपेंटिंग मॉडल के माध्यम से पूर्ण-शरीर की गति को पूरा करता है।

Deli Cai, Haoyang Ma, Changxing Ding2026-05-14
🤖 AI

Weakly-Supervised Spatiotemporal Anomaly Detection

यह शोध पत्र एक कमजोर रूप से पर्यवेक्षित (weakly-supervised) स्थानिक-कालिक विसंगति पहचान पद्धति प्रस्तावित करता है जो वीडियो क्लिप के भीतर स्थानीयकृत विसंगतियों की पहचान करने के लिए वीडियो-स्तरीय लेबल और एक मल्टीपल इंस्टेंस रैंकिंग लॉस का उपयोग करता है, जो UCF Crime2Local डेटासेट पर अपनी प्रभावशीलता प्रदर्शित करता है।

Urvi Gianchandani, Praveen Tirupattur, Mubarak Shah2026-05-14
🤖 machine learning

High-Rate Quantized Matrix Multiplication II

यह शोध पत्र यह प्रदर्शित करते हुए वेट-ओनली (weight-only) LLM पोस्ट-ट्रेनिंग क्वांटाइजेशन के लिए उच्च-दर क्वांटाइज्ड मैट्रिक्स गुणन की जांच करता है कि कैसे कोवेरिएंस-अवेयर वॉटरफिलिंग (covariance-aware waterfilling) समान-दर आवंटन (equal-rate allocation) में सुधार करती है, वॉटरएसआईसी (WaterSIC) योजना के बेसिस-फ्री और निकट-इष्टतम प्रदर्शन का विश्लेषण करता है, और यह दिखाता है कि रैंडम रोटेशन के साथ GPTQ तुलनीय निकट-इष्टतम परिणाम प्राप्त करता है।

Or Ordentlich, Yury Polyanskiy2026-05-14
💬 NLP

Where Does Reasoning Break? Step-Level Hallucination Detection via Hidden-State Transport Geometry

यह शोध पत्र एक स्टेप-लेवल मतिभ्रम (hallucination) डिटेक्शन फ्रेमवर्क प्रस्तावित करता है जो एक कंट्रास्टिव PCA-आधारित शिक्षक और एक डिस्टिल्ड BiLSTM छात्र का उपयोग करके तर्क संबंधी त्रुटियों को हिडन-स्टेट ट्रांसपोर्ट ज्योमेट्री में स्थानीय विचलन के रूप में पहचानता है, जो सिंगल-पास इन्फरेंस के दौरान पहली त्रुटि को स्थानीयकृत करने में मौजूदा बेसलाइन्स से बेहतर प्रदर्शन करता है।

Tyler Alvarez, Ali Baheri2026-05-14
🤖 AI

(How) Do Large Language Models Understand High-Level Message Sequence Charts?

यह शोध पत्र तीन लार्ज लैंग्वेज मॉडल्स की हाई-लेवल मैसेज सीक्वेंस चार्ट्स (HMSCs) के औपचारिक अर्थ विज्ञान (formal semantics) को समझने की क्षमता का मूल्यांकन करता है, जिससे यह पता चलता है कि हालांकि वे बुनियादी अवधारणाओं पर मजबूत पकड़ प्रदर्शित करते हैं, लेकिन एब्स्ट्रैक्शन (abstraction), कंपोजिशन (composition) और कारण संबंधी निर्भरताओं (causal dependencies) से जुड़े जटिल सिमेंटिक तर्क में महत्वपूर्ण संघर्षों के कारण उनकी समग्र सटीकता मामूली (लगभग 52%) है।

Mohammad Reza Mousavi2026-05-14
🤖 machine learning

MinT: Managed Infrastructure for Training and Serving Millions of LLMs

MinT एक प्रबंधित इंफ्रास्ट्रक्चर सिस्टम है जो एक ही बड़े बेस मॉडल को निवासी रखते हुए और हल्के एडॉप्टर रिवीज़न को गतिशील रूप से प्रबंधित करके लाखों LoRA-आधारित LLM पॉलिसियों के कुशल प्रशिक्षण और सर्विंग को सक्षम बनाता है, जिससे डेंस और MoE आर्किटेक्चर में स्केलेबिलिटी, मेमोरी दक्षता और परिनियोजन गति में महत्वपूर्ण सुधार प्राप्त होता है।

Mind Lab, :, Song Cao, Vic Cao, Andrew Chen, Kaijie Chen, Cleon Cheng, Steven Chiang, Kaixuan Fan, Hera Feng, Huan Feng (…)2026-05-14
🤖 AI

LMPath: Language-Mediated Priors and Path Generation for Aerial Exploration

यह शोध पत्र LMPath प्रस्तुत करता है, जो एक नवीन पाइपलाइन है जो उपग्रह इमेजरी से सिमेंटिक एक्सप्लोरेशन प्रायर्स (semantic exploration priors) बनाने के लिए जनरेटिव लैंग्वेज मॉडल्स और फाउंडेशन विजन मॉडल्स का लाभ उठाता है, जिससे यूएवी (UAVs) को कुशल खोज पथ उत्पन्न करने में सक्षम बनाया जा सके जो बड़े पैमाने के वातावरण में पारंपरिक ज्यामितीय कवरेज पैटर्न की तुलना में काफी बेहतर प्रदर्शन करते हैं।

Jonathan A. Diller, Fernando Cladera, Camillo J. Taylor, Vijay Kumar2026-05-14
🤖 AI

Amplification to Synthesis: A Comparative Analysis of Cognitive Operations Before and After Generative AI

यह शोध पत्र 2016 और 2024 के अमेरिकी राष्ट्रपति चुनावों के X (पूर्व में ट्विटर) डेटा का विश्लेषण करता है ताकि यह प्रदर्शित किया जा सके कि संज्ञानात्मक संचालन (cognitive operations) मौलिक रूप से समान सामग्री के बॉट-संचालित प्रवर्धन (bot-driven amplification) से बदलकर जनरेटिव एआई-संचालित संश्लेषण (generative AI-driven synthesis) में परिवर्तित हो गए हैं, जो मूल सामग्री में उछाल, लेक्सिकल ओवरलैप (lexical overlap) में कमी और कथात्मक रूप से केंद्रित समन्वय (narratively concentrated coordination) द्वारा पहचाना जाता है।

Liz Cho, Dongwook Yoon2026-05-14
🧬 biology

ENSEMBITS: an alphabet of protein conformational ensembles

यह शोध पत्र Ensembits को प्रस्तुत करता है, जो प्रोटीन संरचनात्मक समूहों (conformational ensembles) को प्रदर्शित करने के लिए डिज़ाइन किया गया पहला टोकेनाइज़र है, जो एक नवीन फ्रेम डिस्टिलेशन उद्देश्य (frame distillation objective) के माध्यम से डायनेमिक्स-जागरूक प्रोटीन लैंग्वेज मॉडलिंग को सक्षम करते हुए अवशेष गति (residue motion) और कार्यात्मक गुणों की भविष्यवाणी करने में मौजूदा स्टेटिक स्ट्रक्चर टोकेनाइजर्स से बेहतर प्रदर्शन करता है।

Kaiwen Shi, Carlos Oliver2026-05-14
🤖 machine learning

Di-BiLPS: Denoising induced Bidirectional Latent-PDE-Solver under Sparse Observations

यह शोध पत्र Di-BiLPS को पेश करता है, जो एक एकीकृत न्यूरल फ्रेमवर्क है जो अत्यंत विरल अवलोकनों (3% जितने कम) के तहत अत्याधुनिक सटीकता और दक्षता के साथ फॉरवर्ड और इनवर्स PDE समस्याओं को हल करने के लिए वेरिएशनल ऑटोएनकोडर्स, लेटेंट डिफ्यूजन और कंट्रास्टिव लर्निंग का लाभ उठाता है और ज़ीरो-शॉट सुपर-रिज़ॉल्यूशन को सक्षम बनाता है।

Zhonghao Li, Chaoyu Liu, Qian Zhang2026-05-14