🤖 AI

Li-ViP3D++: Query-Gated Deformable Camera-LiDAR Fusion for End-to-End Perception and Trajectory Prediction

Li-ViP3D++ एक क्वेरी-गेटेड डिफॉर्मेबल फ्यूजन फ्रेमवर्क पेश करता है जो एंड-टू-एंड धारणा और प्रक्षेपवक्र भविष्यवाणी (ट्रैजेक्टरी प्रेडिक्शन) को संयुक्त रूप से अनुकूलित करने के लिए क्वेरी स्पेस में मल्टी-व्यू कैमरा और LiDAR डेटा को पूर्णतः डिफरेंशियल रूप से एकीकृत करता है, जिससे पूर्ववर्ती विधियों की तुलना में nuScenes बेंचमार्क पर बेहतर सटीकता और दक्षता प्राप्त होती है।

Matej Halinkovic, Nina Masarykova, Alexey Vinel, Marek Galinski2026-07-21
🤖 AI

CAM: A Causality-based Analysis Framework for Multi-Agent Code Generation Systems

यह शोध पत्र CAM को प्रस्तुत करता है, जो मल्टी-एजेंट कोड जनरेशन सिस्टम्स (MACGS) के लिए पहला कार्य-कारण-आधारित (causality-based) विश्लेषण ढांचा है, जो सिस्टम की शुद्धता में मध्यवर्ती आउटपुट के योगदान को मात्रात्मक रूप से मापता है ताकि संदर्भ-निर्भर फीचर इंटरैक्शन को प्रकट किया जा सके, हाइब्रिड बैकएंड आर्किटेक्चर को अनुकूलित किया जा सके, और विफलता सुधार (failure repair) एवं कुशल फीचर छंटनी (feature pruning) जैसे व्यावहारिक अनुप्रयोगों को सक्षम बनाया जा सके।

Zongyi Lyu, Zhenlan Ji, Songqiang Chen, Liwen Wang, Yuheng Huang, Shuai Wang, Shing-Chi Cheung2026-07-21
🔬 applied physics

SoMA: A Real-to-Sim Neural Simulator for Robotic Soft-body Manipulation

यह शोध पत्र SoMA को प्रस्तुत करता है, जो एक 3D गॉसियन स्प्लेट-आधारित न्यूरल सिम्युलेटर है जो पूर्व-निर्धारित भौतिक मॉडलों पर निर्भर किए बिना सटीक, स्थिर और सामान्यीकरण योग्य रियल-टू-सिम सॉफ्ट-बॉडी मैनिपुलेशन प्राप्त करने के लिए लेटेंट स्पेस में डिफॉर्मेबल डायनेमिक्स, पर्यावरणीय बलों और रोबोटिक क्रियाओं को एकीकृत करता है।

Mu Huang, Hui Wang, Kerui Ren, Linning Xu, Yunsong Zhou, Mulin Yu, Bo Dai, Jiangmiao Pang2026-07-21
💬 NLP

GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning

यह शोधपत्र GradAlign को प्रस्तुत करता है, जो एक ग्रेडिएंट-अलाइन्ड डेटा चयन पद्धति है जो एक विश्वसनीय वैलिडेशन सेट का लाभ उठाकर उन प्रशिक्षण समस्याओं को प्राथमिकता देती है जिनके पॉलिसी ग्रेडिएंट्स संरेखित (aligned) हैं, जिससे एक अनुकूली पाठ्यक्रम (adaptive curriculum) स्थापित होता है जो चुनौतीपूर्ण डेटा व्यवस्थाओं में एलएलएम (LLM) सुदृढीकरण शिक्षण की स्थिरता और प्रदर्शन में महत्वपूर्ण सुधार करता है।

Ningyuan Yang, Weihua Du, Weiwei Sun, Sean Welleck, Yiming Yang2026-07-21
🤖 machine learning

Rooted Absorbed Prefix Trajectory Balance with Submodular Replay for GFlowNet Training

यह शोध पत्र RapTB प्रस्तुत करता है, जो एक GFlowNet प्रशिक्षण उद्देश्य है जो अवशोषित प्रत्यय-आधारित बैकअप (absorbed suffix-based backups) के माध्यम से प्रारंभिक प्रीफिक्स के लिए क्रेडिट असाइनमेंट में सुधार करता है, और SubM, एक उप-मॉड्यूलर रिप्ले रणनीति जो वितरण विस्थापन (distribution shift) को कम करने के लिए है, जो सामूहिक रूप से मोड कोलैप्स को संबोधित करते हैं और अणु निर्माण (molecule generation) जैसे कार्यों में विविधता को बढ़ाते हैं।

Xi Wang, Wenbo Lu, Shengjie Wang2026-07-21
🤖 AI

When Cultures Move: Measuring and Improving Multicultural Text-to-Video Generation

यह शोध पत्र MAVEN को प्रस्तुत करता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो विशेष प्रॉम्प्ट रिफाइनमेंट के माध्यम से टेक्स्ट-टू-वीडियो जनरेशन में सांस्कृतिक निष्ठा (cultural fidelity) को बढ़ाता है, जिसे चीनी, अमेरिकी और रोमानियाई संदर्भों में 243 सांस्कृतिक रूप से आधारित प्रॉम्प्ट और 972 वीडियो के एक नए बेंचमार्क द्वारा सत्यापित किया गया है।

Shuowei Li, Yuming Zhao, Parth Bhalerao, Oana Ignat2026-07-21
🤖 AI

AI for Auto-Research: Roadmap & User Guide

यह शोध पत्र अप्रैल 2026 तक संपूर्ण अनुसंधान जीवनचक्र में एआई (AI) की क्षमताओं और सीमाओं का विश्लेषण करता है, और यह निष्कर्ष निकालता है कि जहाँ स्वचालित प्रणालियाँ संरचित कार्यों को कुशलतापूर्वक संभाल सकती हैं, वहीं वे नवीन वैज्ञानिक निर्णय के लिए अविश्वसनीय बनी हुई हैं, जिसके लिए अनुसंधान अखंडता सुनिश्चित करने हेतु एक मानव-शासित सहयोग मॉडल की आवश्यकता है।

Lingdong Kong, Xian Sun, Wei Chow, Linfeng Li, Kevin Qinghong Lin, Xuan Billy Zhang, Song Wang, Rong Li, Qing Wu, Wei Ga (…)2026-07-21
💬 NLP

Beyond Multilingual Averages: MTEB-PT, a Benchmark for Portuguese Sentence Encoders

यह शोध पत्र MTEB-PT को प्रस्तुत करता है, जो एक व्यापक पुर्तगाली बेंचमार्क है जो यह प्रदर्शित करता है कि बहुभाषी रैंकिंग विविध कार्यों में पुर्तगाली-विशिष्ट प्रदर्शन की भविष्यवाणी करने में विफल रहती है, जबकि यह दर्शाता है कि मैट्रोस्का प्रतिनिधित्व शिक्षण (Matryoshka Representation Learning) के साथ भाषा-विशिष्ट फाइन-ट्यूनिंग मॉडल की प्रभावशीलता को महत्वपूर्ण रूप से बढ़ाती है, विशेष रूप से सिमेंटिक समानता और लॉन्ग-कॉन्टेक्स्ट रिट्रीवल के लिए।

Lucas Hideki Takeuchi Okamura, Alexandre Alcoforado, Anna Helena Reali Costa2026-07-21
🤖 AI

ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog

ResearchStudio-Reel एक नेटिव-एडिटेबल प्रसार वर्कस्पेस है जो शोध पत्रों को इंटरैक्टिव, मल्टी-फॉर्मेट डिलिवरेबल्स (पोस्टर, वीडियो और ब्लॉग) में रूपांतरित करने को स्वचालित करता है, जो संपादन योग्य आर्टिफ़ेक्ट्स को एक एकीकृत व्यूअर में बांधकर, Paper2Poster बेंचमार्क पर सौंदर्य और सूचनात्मक गुणवत्ता दोनों में अत्याधुनिक प्रदर्शन प्राप्त करता है।

Lingao Xiao, Yalun Dai, Yangyu Huang, Qihao Zhao, Wenshan Wu, Hugo He, Ruishuo Chen, Jin Jiang, Qianli Ma, Jiahuan Zhang (…)2026-07-21
🤖 AI

SmartRAG: Native Graph-Based RAG for Mobile Device

SmartRAG एक पूर्णतः ऑन-डिवाइस फ्रेमवर्क है जो बुद्धिमत्ता को एक निरंतर सीखने योग्य एंटिटी रिकग्नाइज़र और एक तीन-स्तरीय नॉलेज ग्राफ पर केंद्रित समन्वित मॉड्यूल में विभाजित करके कमोडिटी स्मार्टफोन पर प्रतिस्पर्धी मल्टी-हॉप रीजनिंग प्रदर्शन प्राप्त करता है, जिससे बिना किसी बड़े मॉडल संपीड़न की आवश्यकता के कुशल, निजी और ऑफलाइन LLM सहायता सक्षम होती है।

Zhihan Jiang, Meng Li, Shenghao Liu, Keran Li, Ruiben Zhou, Wei Wang, Xianjun Deng, Shuai Wang, Haipeng Dai2026-07-21