🤖 AI

Perception, Verdict, and Evolution: Hindsight-Driven Self-Refining Forensics Agent for AI-Generated Image Detection

ForeAgent एक स्व-विकसित मल्टीमॉडल फोरेंसिक एजेंट है जो मल्टी-व्यू परसेप्शन-वर्डिक्ट आर्किटेक्चर को हिंडसाइट-संचालित रिफ्लेक्शन रणनीति के साथ जोड़ता है ताकि अपने तर्क को पुनरावृत्ति से परिष्कृत किया जा सके और एआई-जनरेटेड छवियों का पता लगाने में अत्याधुनिक प्रदर्शन प्राप्त किया जा सके।

Yangjun Wu, Keyu Yan, Yu Liu, Jingren Zhou, Fei Huang, Rong Zhang, Zhou Zhao, Fei Wu2026-06-26
💻 computer science

Temporally Consistent Label Interpolation for Robust Surgical Multi-Task Learning under Challenging Conditions

यह शोध पत्र FAROS का प्रस्ताव करता है, जो एक फ्लो-गाइडेड लेबल इंटरपोलेशन फ्रेमवर्क है जो चुनौतीपूर्ण परिस्थितियों में सर्जिकल सीन अंडरस्टैंडिंग के लिए रोबस्ट मल्टी-टास्क लर्निंग को बढ़ाने और सुपरविजन असंतुलन को दूर करने के लिए स्पार्स एनोटेशन से टेम्पोरली कंसिस्टेंट डेंस स्यूडो-लेबल्स उत्पन्न करता है।

Garam Kim, Juyoun Park2026-06-26
💻 computer science

Intracranial Aneurysm Classification and Segmentation via Tri-Axial ROI and Multi-Task Learning

यह शोध पत्र एक मल्टी-टास्क लर्निंग फ्रेमवर्क प्रस्तुत करता है जो 13 शारीरिक स्थलों और चार इमेजिंग मोडैलिटीज में इंट्राक्रैनील एन्यूरिज्म को एक साथ वर्गीकृत करने, सेगमेंट करने और स्थानीयकृत करने के लिए 2D ट्राइएक्सियल ROI निष्कर्षण को 3D nnU-Net बैकबोन के साथ जोड़ता है, जिसने RSNA 2025 चुनौती में दूसरा स्थान प्राप्त किया है।

Pengcheng Shi, Kaiyuan Yang, Houjing Huang, Jiawei Chen, Yan Lu, Jiaqi Liu, Murong Xu, Bjoern Menze, Xinglin Zhang2026-06-26
⚡ electrical engineering

MLFFM-SegDiff: A Multi-Level Feature Fusion Diffusion Model for Skin Lesion Segmentation

यह शोध पत्र MLFFM-SegDiff प्रस्तावित करता है, जो एक मल्टी-लेवल फीचर फ्यूजन डिफ्यूजन मॉडल है जो डर्मोस्कोपिक छवियों में धुंधली सीमाओं और आर्टिफैक्ट्स जैसी चुनौतियों से निपटने के लिए एक डुअल-पाथ यू-नेट एनकोडर, एक अटेंशन-आधारित फ्यूजन मॉड्यूल और एक बाउंड्री-सेंसिटिव लॉस को एकीकृत करता है, जिससे स्किन लीजन सेगमेंटेशन बेंचमार्क पर स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त होता है।

Jingjun Gu, Chaojie Shen, Yifeng Cao, Wei Zhang, Yiliu Li, Aobo Fan2026-06-26
🤖 AI

A Latent ODE Approach to Spatiotemporal Modeling of Cine Cardiac MRI

यह शोध पत्र एक लेटेंट ODE फ्रेमवर्क पेश करता है जो कार्डियक एमआरआई से निरंतर पूर्ण-चक्र वेंट्रिकुलर गति को एक प्रोग्नोस्टिक लेटेंट प्रक्षेपवक्र (ट्रैजेक्टरी) में एनकोड करता है, जो एक बड़े यूके बायोबैंक कोहोर्ट में पारंपरिक सूचकांकों और स्थापित कार्डियक मार्करों की तुलना में घटित होने वाली हार्ट फेल्योर के बेहतर पूर्वानुमान को प्रदर्शित करता है।

David Brüggemann, Ekaterina Krymova, Firat Özdemir, Jochen von Spiczak, Sebastian Kozerke, Samia Mora, Robert Manka, Mat (…)2026-06-26
💻 computer science

Full spectrum Unlearnable Examples via Spectral Equalization

यह शोध पत्र FUSE को प्रस्तुत करता है, जो फुल-स्पेक्ट्रम अनलर्नेबल उदाहरणों (unlearnable examples) को उत्पन्न करने की एक नवीन विधि है, जो रैंडम स्पेक्ट्रल मास्किंग और क्रॉस-बैंड गाइडेंस का उपयोग करके मौजूदा हाई-फ्रीक्वेंसी-डिपेंडेंट परटर्बेशन्स की सीमाओं को दूर करती है ताकि सभी फ्रीक्वेंसी बैंड्स में सुदृढ़ डेटा सुरक्षा सुनिश्चित की जा सके।

Jiale Cai, Gezheng Xu, Zhihao Li, Ruiyi Fang, Ruizhi Pu, Di Wu, Qicheng Lao, Charles Ling, Boyu Wang2026-06-26
🤖 AI

Robust Onion: Peeling Open Vocab Object Detectors Under Noise

यह शोध पत्र "Robust Onion" प्रस्तुत करता है, जो एक व्यापक अनुभवजन्य अध्ययन है जो व्यवस्थित रूप से विश्लेषण करता है कि कैसे सिंथेटिक शोर (synthetic noise) ओपन वोकेबुलरी ऑब्जेक्ट डिटेक्टर्स को खराब करता है, यह प्रकट करते हुए कि मजबूती मुख्य रूप से विज़न बैकबोन में इमेज डोमेन और फीचर कोलैप्स द्वारा शासित होती है न कि एनोटेशन द्वारा, जिससे एक हल्का प्लग-एंड-प्ले तरीका प्राप्त होता है जो न्यूनतम प्रशिक्षण योग्य मापदंडों के साथ मजबूती में महत्वपूर्ण सुधार करता है।

Priyank Pathak, Mukilan Karuppasamy, Aaditya Baranwal, Shruti Vyas, Yogesh S Rawat2026-06-26
💻 computer science

Do Image Editing Models Understand Lighting?

यह शोध पत्र 3D-एंकोर्ड लाइट प्रोब (3DLP) बेंचमार्क प्रस्तुत करता है, जिसमें वास्तविक दुनिया के प्रकाश परिवर्तनों का एक नया उच्च-सटीकता वाला HDR डेटासेट शामिल है, ताकि यह मूल्यांकन और खुलासा किया जा सके कि यद्यपि अत्याधुनिक इमेज एडिटिंग मॉडल वास्तविक दुनिया के भौतिकी के साथ उल्लेखनीय निरंतरता प्रदर्शित करते हैं, फिर भी वे कम रोशनी वाले क्षेत्रों में महत्वपूर्ण त्रुटियां प्रदर्शित करते हैं और सटीक लाइट ट्रांसपोर्ट विश्लेषण के लिए आवश्यक पिक्सेल-स्तरीय सटीकता की कमी रखते हैं।

Tim Küchler, Johann-Friedrich Feiden, Matthias Nießner, Carsten Rother2026-06-26
💻 computer science

PressMimic: Pressure-Guided Motion Capture and Control for Humanoid Robot Imitation

PressMimic एक ऐसा फ्रेमवर्क है जो मोशन कैप्चर (FRAPPE++ मॉडल के माध्यम से) और नियंत्रण (प्रेशर-सुपरवाइज्ड पॉलिसी के माध्यम से) दोनों को बढ़ाने के लिए दबाव डेटा (pressure data) को एक एकीकृत मोडैलिटी के रूप में उपयोग करता है, जिससे दृश्य अस्पष्टताओं (visual ambiguities) को दूर किया जा सके और भौतिक रूप से सुसंगत, स्थिर ह्यूमनॉइड मोशन इमिटेशन सुनिश्चित किया जा सके।

Yi Lu, Shenghao Ren, Tianyu Xiong, Zhaoxiang Li, Jiaqi Li, He Zhang, Tao Yu, Qiu Shen, Xun Cao2026-06-26
💻 computer science

Depth-Semantic Alignment and Affinity-Guided Fusion for Structured Radar Point Cloud Generation

यह शोधपत्र एक विजन-रडार फ्यूजन पद्धति प्रस्तावित करता है जो संरचनात्मक संरेखण (स्ट्रक्चरल अलाइनमेंट) और स्पार्स कंप्लीशन के लिए इमेज सिमेंटिक्स का लाभ उठाता है ताकि उच्च-गुणवत्ता वाले, घने रडार पॉइंट क्लाउड्स उत्पन्न किए जा सकें, जिससे डाउनस्ट्रीम ऑब्जेक्ट डिटेक्शन और ट्रैकिंग कार्यों की सटीकता और मजबूती में महत्वपूर्ण सुधार होता है।

Amjad Hussain, Xin Qiu, Fuyuan Ai, Yuchen Tan, Zecheng Li, Chunyi Song, Wenjie Liu2026-06-26