💻 computer science

Forget, Anticipate and Adapt: Test Time Training for Long Videos

यह शोध पत्र फ्रेम फॉरगेटिंग नेटवर्क (FFN) को प्रस्तुत करता है, जो लंबे वीडियो के लिए एक गणनात्मक रूप से कुशल टेस्ट टाइम ट्रेनिंग दृष्टिकोण है, जो वास्तविक समय में बिना लेबल के मॉडल अनुकूलन को सक्षम करने के लिए एक निश्चित तीन-फ्रेम विंडो और एक अनुकूली सरप्राइज-आधारित तंत्र का उपयोग करता है, जिसे एक घंटे लंबे वीडियो के नए डेटासेट पर सत्यापित किया गया है।

Rajat Modi, Sebastian Noel, Xin Liang, Yogesh Singh Rawat2026-06-26
💬 NLP

The Inattentional Gap: Task-Conditioned Language and Vision Models Omit the Safety-Critical Signals They Can Otherwise Report

यह शोध पत्र "इनअटेंशनल गैप" (Inattentional Gap) को प्रस्तुत करता है, जो एक ऐसी घटना है जहाँ कार्य-आधारित (task-conditioned) एआई मॉडल व्यवस्थित रूप से उन सुरक्षा-महत्वपूर्ण संकेतों को रिपोर्ट करने की अपनी क्षमता को दबा देते हैं जिन्हें वे अन्यथा पहचान सकते हैं, जिससे बेंचमार्क सुरक्षा स्कोर और वास्तविक दुनिया की विश्वसनीयता के बीच एक खतरनाक विच्छेद उत्पन्न होता है।

Kwan Soo Shin2026-06-26
🤖 AI

From Hallucination to Grounding: Diagnosing Visual Spatial Intelligence via CRISP

यह शोध पत्र CRISP को प्रस्तुत करता है, जो एक नवीन नैदानिक मूल्यांकन प्रतिमान (diagnostic evaluation paradigm) है जो धारणा (perception) को तर्क (reasoning) से अलग करने के लिए मीट्रिक 3D सीन ग्राफ और ओरेकल हस्तक्षेपों का उपयोग करता है, जिससे यह पता चलता है कि जहाँ प्रोप्राइटरी मॉडल मजबूत लेटेंट रीजनिंग के बावजूद सटीक मीट्रिक अनुमान में त्रुटिपूर्ण होते हैं, वहीं ओपन-सोर्स मॉडल मौलिक रूप से मल्टी-हॉप कंपोजिशनल रीजनिंग की कमी से सीमित हैं।

Zhixing Li, Yinan Yu2026-06-26
🤖 AI

Perception, Verdict, and Evolution: Hindsight-Driven Self-Refining Forensics Agent for AI-Generated Image Detection

ForeAgent एक स्व-विकसित मल्टीमॉडल फोरेंसिक एजेंट है जो मल्टी-व्यू परसेप्शन-वर्डिक्ट आर्किटेक्चर को हिंडसाइट-संचालित रिफ्लेक्शन रणनीति के साथ जोड़ता है ताकि अपने तर्क को पुनरावृत्ति से परिष्कृत किया जा सके और एआई-जनरेटेड छवियों का पता लगाने में अत्याधुनिक प्रदर्शन प्राप्त किया जा सके।

Yangjun Wu, Keyu Yan, Yu Liu, Jingren Zhou, Fei Huang, Rong Zhang, Zhou Zhao, Fei Wu2026-06-26
💻 computer science

Temporally Consistent Label Interpolation for Robust Surgical Multi-Task Learning under Challenging Conditions

यह शोध पत्र FAROS का प्रस्ताव करता है, जो एक फ्लो-गाइडेड लेबल इंटरपोलेशन फ्रेमवर्क है जो चुनौतीपूर्ण परिस्थितियों में सर्जिकल सीन अंडरस्टैंडिंग के लिए रोबस्ट मल्टी-टास्क लर्निंग को बढ़ाने और सुपरविजन असंतुलन को दूर करने के लिए स्पार्स एनोटेशन से टेम्पोरली कंसिस्टेंट डेंस स्यूडो-लेबल्स उत्पन्न करता है।

Garam Kim, Juyoun Park2026-06-26
💻 computer science

Intracranial Aneurysm Classification and Segmentation via Tri-Axial ROI and Multi-Task Learning

यह शोध पत्र एक मल्टी-टास्क लर्निंग फ्रेमवर्क प्रस्तुत करता है जो 13 शारीरिक स्थलों और चार इमेजिंग मोडैलिटीज में इंट्राक्रैनील एन्यूरिज्म को एक साथ वर्गीकृत करने, सेगमेंट करने और स्थानीयकृत करने के लिए 2D ट्राइएक्सियल ROI निष्कर्षण को 3D nnU-Net बैकबोन के साथ जोड़ता है, जिसने RSNA 2025 चुनौती में दूसरा स्थान प्राप्त किया है।

Pengcheng Shi, Kaiyuan Yang, Houjing Huang, Jiawei Chen, Yan Lu, Jiaqi Liu, Murong Xu, Bjoern Menze, Xinglin Zhang2026-06-26
⚡ electrical engineering

MLFFM-SegDiff: A Multi-Level Feature Fusion Diffusion Model for Skin Lesion Segmentation

यह शोध पत्र MLFFM-SegDiff प्रस्तावित करता है, जो एक मल्टी-लेवल फीचर फ्यूजन डिफ्यूजन मॉडल है जो डर्मोस्कोपिक छवियों में धुंधली सीमाओं और आर्टिफैक्ट्स जैसी चुनौतियों से निपटने के लिए एक डुअल-पाथ यू-नेट एनकोडर, एक अटेंशन-आधारित फ्यूजन मॉड्यूल और एक बाउंड्री-सेंसिटिव लॉस को एकीकृत करता है, जिससे स्किन लीजन सेगमेंटेशन बेंचमार्क पर स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त होता है।

Jingjun Gu, Chaojie Shen, Yifeng Cao, Wei Zhang, Yiliu Li, Aobo Fan2026-06-26
🤖 AI

A Latent ODE Approach to Spatiotemporal Modeling of Cine Cardiac MRI

यह शोध पत्र एक लेटेंट ODE फ्रेमवर्क पेश करता है जो कार्डियक एमआरआई से निरंतर पूर्ण-चक्र वेंट्रिकुलर गति को एक प्रोग्नोस्टिक लेटेंट प्रक्षेपवक्र (ट्रैजेक्टरी) में एनकोड करता है, जो एक बड़े यूके बायोबैंक कोहोर्ट में पारंपरिक सूचकांकों और स्थापित कार्डियक मार्करों की तुलना में घटित होने वाली हार्ट फेल्योर के बेहतर पूर्वानुमान को प्रदर्शित करता है।

David Brüggemann, Ekaterina Krymova, Firat Özdemir, Jochen von Spiczak, Sebastian Kozerke, Samia Mora, Robert Manka, Mat (…)2026-06-26
💻 computer science

Full spectrum Unlearnable Examples via Spectral Equalization

यह शोध पत्र FUSE को प्रस्तुत करता है, जो फुल-स्पेक्ट्रम अनलर्नेबल उदाहरणों (unlearnable examples) को उत्पन्न करने की एक नवीन विधि है, जो रैंडम स्पेक्ट्रल मास्किंग और क्रॉस-बैंड गाइडेंस का उपयोग करके मौजूदा हाई-फ्रीक्वेंसी-डिपेंडेंट परटर्बेशन्स की सीमाओं को दूर करती है ताकि सभी फ्रीक्वेंसी बैंड्स में सुदृढ़ डेटा सुरक्षा सुनिश्चित की जा सके।

Jiale Cai, Gezheng Xu, Zhihao Li, Ruiyi Fang, Ruizhi Pu, Di Wu, Qicheng Lao, Charles Ling, Boyu Wang2026-06-26
🤖 AI

Robust Onion: Peeling Open Vocab Object Detectors Under Noise

यह शोध पत्र "Robust Onion" प्रस्तुत करता है, जो एक व्यापक अनुभवजन्य अध्ययन है जो व्यवस्थित रूप से विश्लेषण करता है कि कैसे सिंथेटिक शोर (synthetic noise) ओपन वोकेबुलरी ऑब्जेक्ट डिटेक्टर्स को खराब करता है, यह प्रकट करते हुए कि मजबूती मुख्य रूप से विज़न बैकबोन में इमेज डोमेन और फीचर कोलैप्स द्वारा शासित होती है न कि एनोटेशन द्वारा, जिससे एक हल्का प्लग-एंड-प्ले तरीका प्राप्त होता है जो न्यूनतम प्रशिक्षण योग्य मापदंडों के साथ मजबूती में महत्वपूर्ण सुधार करता है।

Priyank Pathak, Mukilan Karuppasamy, Aaditya Baranwal, Shruti Vyas, Yogesh S Rawat2026-06-26