🔭 astrophysics

Co-addition and Subtraction of Undersampled Images

यह शोधपत्र LUTRA को प्रस्तुत करता है, जो एक नवीन ओपन-सोर्स विधि है जो सुपर-रिज़ॉल्यूशन प्राप्त करने, गलत सूचनाओं (फॉल्स अलार्म) को कम करने और वर्तमान तकनीकों की तुलना में सिग्नल-टू-नॉइज़ अनुपात में 25% सुधार करने के लिए अंडरसैम्पल्ड खगोलीय छवियों के को-एडिशन और बैकग्राउंड सबट्रैक्शन को गणितीय रूप से अनुकूलित करता है।

Matan Schlanger, Barak Zackay2026-07-21
💻 computer science

QIRF Quantum-Inspired Non-Orthogonal Function-Space Compression for 3D Gaussian Splatting

QIRF एक क्वांटम-प्रेरित, गैर-ऑर्थोगोनल फंक्शन-स्पेस संपीड़न विधि पेश करता है जो 3D गॉसियन स्प्लेटिंग के लिए एक ओवरलैप मैट्रिक्स पर सामान्यीकृत आइजनडिकंपोजिशन (generalized eigendecomposition) का लाभ उठाता है ताकि प्रतिनिधि प्रिमिटिव्स की पहचान और चयन किया जा सके, जिससे पुनर्निर्माण गुणवत्ता और गति को बनाए रखते हुए या थोड़ा सुधारते हुए भंडारण और रेंडरिंग लागत में महत्वपूर्ण कमी आती है।

Shizeng Jiang, Hao Zhang, Xuerui Ma, Ying Hu, Tao Zhang2026-07-21
💻 computer science

VGOcc: Learning Visual-Geometric Gaussians for Vision-Centric 3D Driving Occupancy Prediction

VGOcc एक नवीन विज़न-केंद्रित 3D ड्राइविंग ऑक्यूपेंसी प्रेडिक्शन फ्रेमवर्क पेश करता है जो स्पार्स गॉसियन प्रिमिटिव्स को इनिशियलाइज़ और रिफाइन करने के लिए फाउंडेशन मॉडल्स से विजुअल और ज्योमेट्रिक संकेतों का लाभ उठाता है, जिससे nuScenes डेटासेट पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Junhong Lin, Xianda Guo, Kangli Wang, Yuqi Ye, Xiaoyu Liang, Yanlun Peng, Wei Gao2026-07-21
🤖 machine learning

Empowering On-Device Model Adaptation with an Edge AI Inference Accelerator

यह शोध पत्र एक हेट्रोजेनियस अडैप्टेशन पाइपलाइन का प्रस्ताव करता है जो फ्रोजन-बैकबोन फीचर एक्सट्रैक्शन के लिए Hailo-8L एज एआई इन्फरेंस एक्सेलेरेटर को पुनरुद्देश्यित करता है और होस्ट CPU पर एक लाइटवेट क्लासिफिकेशन हेड को फाइन-ट्यून करता है, जिससे ऊर्जा-कुशल, उच्च-गति ऑन-डिवाइस मॉडल अडैप्टेशन सक्षम होता है जो CPU-ओनली बेसलाइन्स से काफी बेहतर प्रदर्शन करता है।

Mateusz Piechocki, Alessandro Capotondi, Marek Kraft2026-07-21
💻 computer science

SpEmoC: A Balanced Speaker-Segment Multimodal Emotion Benchmark

यह शोध पत्र SpEmoC को प्रस्तुत करता है, जो 3,100 अंग्रेजी फिल्मों और टीवी श्रृंखलाओं से प्राप्त एक बड़े पैमाने का, क्लास-बैलेंस्ड मल्टीमॉडल इमोशन बेंचमार्क है जिसमें सख्त कंटेंट-लेवल स्प्लिट्स हैं, जो यह प्रदर्शित करता है कि संतुलित डेटा और कठोर विभाजन विविध कार्यों में इमोशन रिकग्निशन मॉडल की स्थिरता और सामान्यीकरण क्षमता को महत्वपूर्ण रूप से सुधारते हैं।

Sania Bano, Shahzad Ahmad, Santosh Kumar Vipparthi, Sukalpa Chanda, Subrahmanyam Murala2026-07-21
💻 computer science

Robust Multimodal Dynamic Object Segmentation

यह शोध पत्र एक सुदृढ़ मल्टीमॉडल डायनेमिक ऑब्जेक्ट सेगमेंटेशन फ्रेमवर्क प्रस्तुत करता है जो सटीक, सुसंगत सेगमेंटेशन और उच्च-गुणवत्ता वाले स्टैटिक सीन पुनर्निर्माण को प्राप्त करने के लिए एक ट्रांसफॉर्मर-आधारित नेटवर्क और एक नवीन पॉइंट-क्वेरी SAM पोस्ट-प्रोसेसिंग विधि के माध्यम से 2D पॉइंट ट्रैक्स, 3D पुनर्निर्माण और सिमेंटिक जानकारी को एकीकृत करता है, जो मौजूदा अत्याधुनिक दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Zhe Xin, Hanzhi Chang, Penghui Huang, Yinian Mao, Guoquan Huang2026-07-21
🤖 machine learning

Three-Body Scattering for Generative Modeling

यह शोध पत्र थ्री-बॉडी स्कैटरिंग मॉडलिंग (TBSM) प्रस्तुत करता है, जो एक नवीन जनरेटिव फ्रेमवर्क है जो सैंपल-लेवल मोशन को प्रेरित करने और प्रत्यक्ष रिग्रेशन सुपरविजन प्रदान करने के लिए एक डिस्ट्रीब्यूशनल एनर्जी का उपयोग करता है, जिससे जटिल ऑल-पेयर इंटरैक्शन को कुशल कॉन्स्टेंट-साइज़ पर-प्रोजेक्टाइल इंटरैक्शन से बदलकर ImageNet-256 पर स्टेट-ऑफ-द-आर्ट FID स्कोर के साथ उच्च-गुणवत्ता वाला वन-स्टेप जनरेशन सक्षम होता है।

Peng Sun, Zhenglin Cheng, Deyuan Liu, Jun Xie, Xinyi Shang, Tao Lin2026-07-21
💻 computer science

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enchancement

यह शोध पत्र HOMIE को प्रस्तुत करता है, जो मानव-वस्तु केंद्रित वीडियो पर्सनलाइजेशन के लिए एक एकीकृत ढांचा है, जो वैश्विक मल्टीमॉडल मार्गदर्शन और मोडैलिटी-रेफरेंस एम्बेडिंग्स के साथ एक नवीन MLLM एकीकरण रणनीति का लाभ उठाता है ताकि उच्च विषय निष्ठा (subject fidelity) और सटीक मानव-वस्तु इंटरेक्शन पैटर्न को एक साथ प्राप्त किया जा सके।

Yiyang Cai, Nan Chen, Rongchang Xie, Junwen Pan, Chunyang Jiang, Cheng Chen, Wen Zhou, Zhenbang Sun, Wei Xue, Wenhan Luo (…)2026-07-21
🤖 AI

Simple Domain Generalization for Strong Pixel-Level Image Tampering Detection in Modern VLMs

यह शोध पत्र आधुनिक विजन-लैंग्वेज मॉडल्स में पिक्सेल-स्तरीय इमेज टैम्परिंग डिटेक्शन के लिए एक सरल लेकिन प्रभावी डोमेन-जनरलाइजेशन फ्रेमवर्क प्रस्तावित करता है, जो विविध आउट-ऑफ-डिस्ट्रीब्यूशन VLM-जनरेटेड मैनिपुलेशन्स में स्टेट-ऑफ-द-आर्ट रोबस्टनेस प्राप्त करने के लिए बैलेंस्ड मिनीबैच सैंपलिंग और लेट-इंजेक्शन ट्रेनिंग स्ट्रैटेजी का उपयोग करता है।

Yi Tang, Xinyi Shang, Jiacheng Cui, Sondos Mahmoud Bsharat, Jiacheng Liu, Xiaohan Zhao, Tran Dinh Tien, Ahmed Elhagry, S (…)2026-07-21
🤖 machine learning

GAMIVAL: Video Quality Prediction on Mobile Cloud Gaming Content

यह शोध पत्र GAMIVAL को प्रस्तुत करता है, जो एक नवीन नो-रेफरेंस वीडियो गुणवत्ता मूल्यांकन मॉडल है जो मोबाइल क्लाउड गेमिंग सामग्री की गुणवत्ता का सटीक अनुमान लगाने के लिए स्थानिक और टेम्पोरल गेमिंग सांख्यिकी, न्यूरल नॉइज़ मॉडलिंग और गहरे सिमेंटिक फीचर्स को जोड़ता है, जिससे नए LIVE-Meta MCG डेटाबेस पर उत्कृष्ट प्रदर्शन प्राप्त होता है।

Yu-Chih Chen, Avinab Saha, Chase Davis, Bo Qiu, Xiaoming Wang, Rahul Gowda, Ioannis Katsavounidis, Alan C. Bovik2026-07-20