🧬 biology

SPATIA: Multimodal Generation and Prediction of Spatial Cell Phenotypes

SPATIA एक नवीन मल्टीमॉडल जनरेटिव और प्रेडिक्टिव मॉडल है जो ऊतक-स्तरीय विश्लेषण (tissue-level analysis), फेनोटाइप जनरेशन और क्रॉस-मोडल प्रेडिक्शन में मौजूदा तरीकों से बेहतर प्रदर्शन करने के लिए सेल मॉर्फोलॉजी, जीन एक्सप्रेशन और स्पेशियल कॉन्टेक्स्ट को एकीकृत करता है, जिसे एक विशाल मल्टी-स्केल डेटासेट पर प्रशिक्षित कॉन्फिडेंस-अवेयर फ्लो मैचिंग फ्रेमवर्क के माध्यम से बनाया गया है।

Zhenglun Kong, Mufan Qiu, John Boesen, Xiang Lin, Sukwon Yun, Tianlong Chen, Manolis Kellis, Marinka Zitnik2026-06-17
💻 computer science

4DSloMo: 4D Reconstruction for High Speed Scene with Asynchronous Capture

यह शोध पत्र 4DSloMo प्रस्तुत करता है, जो एक उच्च-गति वाली 4D पुनर्निर्माण प्रणाली है जो एक एसिंक्रोनस कैप्चर स्कीम और विरल दृष्टिकोणों (sparse viewpoints) से उत्पन्न आर्टिफैक्ट्स को ठीक करने के लिए एक नवीन वीडियो-डिफ्यूजन-आधारित जनरेटिव मॉडल का उपयोग करके मानक 25 FPS कैमरों के माध्यम से 100–200 FPS की समतुल्य फ्रेम दर प्राप्त करती है।

Yutian Chen, Shi Guo, Tianshuo Yang, Lihe Ding, Xiuyuan Yu, Jinwei Gu, Tianfan Xue2026-06-17
💻 computer science

BusterX++: Towards Unified Cross-Modal AI-Generated Content Detection and Explanation with MLLM

यह शोध पत्र एआई-जनित छवियों और वीडियो का पता लगाने और उन्हें समझाने के लिए एक एकीकृत एमएलएलएम (MLLM), बस्टरएक्स++ (BusterX++), के साथ-साथ जेनबस्टर-बेंच++ (GenBuster-Bench++) बेंचमार्क प्रस्तुत करता है, जो यह प्रदर्शित करता है कि एक एकल-चरणीय शुद्ध सुदृढीकरण लर्निंग (reinforcement learning) रणनीति पारंपरिक एसएफटी+आरएल (SFT+RL) दृष्टिकोणों से बेहतर प्रदर्शन करती है क्योंकि यह स्वतःस्फूर्त क्रॉस-मोडल क्षमता हस्तांतरण को सक्षम करने के लिए पॉलिसी एंट्रॉपी (policy entropy) को संरक्षित करती है।

Haiquan Wen, Tianxiao Li, Zhenglin Huang, Yiwei He, Guangliang Cheng2026-06-17
🤖 machine learning

Adversarial Attacks Leverage Interference Between Features in Superposition

यह शोध पत्र यह प्रस्तावित करता है कि न्यूरल नेटवर्क में एडवरसेरियल भेद्यता (adversarial vulnerability) और ट्रांसफ़रेबिलिटी (transferability) "सुपरपोजिशन" से उत्पन्न होती है, जहाँ कुशल सूचना एनकोडिंग गैर-ऑर्थोगोनल (non-orthogonal) निरूपणों को मजबूर करती है जो विशेषताओं के बीच हस्तक्षेप का कारण बनती है, जिससे लक्षित गड़बड़ी (targeted perturbations) अनजाने में अन्य अवधारणाओं को प्रभावित करती है।

Edward Stevinson, Lucas Prieto, Melih Barsbey, Tolga Birdal2026-06-17
🤖 AI

A geometric and deep learning reproducible pipeline for monitoring floating anthropogenic debris in urban rivers using in situ cameras

यह शोधपत्र एक पुनरुत्पादक पाइपलाइन प्रस्तुत करता है जो इन-सीटू (in-situ) कैमरों का उपयोग करके शहरी नदियों में तैरते मानवजनित मलबे की मजबूत, कम लागत वाली, स्वचालित निगरानी और मीट्रिक आकार अनुमान को सक्षम करने के लिए डीप लर्निंग और प्रक्षेपिक ज्यामिति (projective geometry) को संयोजित करता है।

Gauthier Grimmer, Romain Wenger, Clément Flint, Germain Forestier, Gilles Rixhon, Valentin Chardon2026-06-17
⚡ electrical engineering

Learning QoE from Packet-Level Measurements in Encrypted Video Conferencing Traffic

यह शोध पत्र एक हल्का, CNN-आधारित फ्रेमवर्क प्रस्तावित करता है जो केवल एन्क्रिप्टेड पैकेट आकार डेटा का उपयोग करके BRISQUE और MOS जैसे वीडियो कॉन्फ्रेंसिंग गुणवत्ता के अनुभव (QoE) मेट्रिक्स की सटीक भविष्यवाणी करता है, जिससे ISPs को सामग्री तक पहुँच बनाए बिना प्रदर्शन का आकलन करने में सक्षम बनाया जा सके।

Michael Sidorov, Ofer Hadar2026-06-17
💻 computer science

Synthetic Data Guided Feature Selection for Robust Activity Recognition in Older Adults

यह अध्ययन प्रदर्शित करता है कि सिंथेटिक डेटा द्वारा निर्देशित एक फीचर हस्तक्षेप मॉडल (feature intervention model) वृद्ध वयस्कों के लिए मानव गतिविधि पहचान की मजबूती और सटीकता में महत्वपूर्ण सुधार करता है, विशेष रूप से हिप फ्रैक्चर पुनर्वास के दौरान नैदानिक रूप से महत्वपूर्ण पोस्चरल ट्रांसफर्स (postural transfers) का पता लगाने को बढ़ाता है।

Shuhao Que, Dieuwke van Dartel, Ilse Heeringa, Han Hegeman, Miriam Vollenbroek-Hutten, Ying Wang2026-06-17
🤖 AI

m2sv: A Scalable Benchmark for Map-to-Street-View Spatial Reasoning

यह शोध पत्र m2sv को प्रस्तुत करता है, जो मैप-टू-स्ट्रीट-व्यू स्थानिक तर्क (spatial reasoning) के लिए एक स्केलेबल बेंचमार्क और संबद्ध फाइन-ट्यूनिंग डेटासेट है, जो यह प्रकट करता है कि अन्य कार्यों पर मजबूत प्रदर्शन के बावजूद, वर्तमान विजन-लैंग्वेज मॉडल मानव एनोटेटरों की तुलना में ज्यामितीय संरेखण (geometric alignment) और व्यूपॉइंट अनुमान (viewpoint inference) में संघर्ष करते हैं।

Yosub Shin, Michael Buriek, Igor Molybog2026-06-17
💻 computer science

Partial Ring Scan: Revisiting Scan Order in Vision State Space Models

यह शोध पत्र PRISMamba प्रस्तुत करता है, जो एक रोटेशन-रोबस्ट विजन स्टेट स्पेस मॉडल है जो निश्चित रैखिक स्कैन क्रमों को संकेंद्रित वलय-आधारित ट्रैवर्सल और आंशिक चैनल फ़िल्टरिंग से बदलकर सटीकता, दक्षता और ज्यामितीय स्थिरता में सुधार करता है।

Yi-Kuan Hsieh, Kuan-Chuan Peng, Xin li, Ming-Ching Chang, Yu-Chee Tseng, Jun-Wei Hsieh2026-06-17
🤖 machine learning

RAIGen: Rare Attribute Identification in Text-to-Image Generative Models

यह शोध पत्र RAIGen को प्रस्तुत करता है, जो Matryoshka Sparse Autoencoders और एक नवीन अल्पसंख्यक मीट्रिक (minority metric) का उपयोग करके टेक्स्ट-टू-इमेज डिफ्यूजन मॉडल्स में दुर्लभ या कम प्रतिनिधित्व वाले सिमेंटिक गुणों की खोज के लिए पहला लेबल-मुक्त फ्रेमवर्क है, जो न्यूरॉन एक्टिवेशन फ्रीक्वेंसी को सिमेंटिक विशिष्टता के साथ जोड़ता है।

Silpa Vadakkeeveetil Sreelatha, Dan Wang, Serge Belongie, Muhammad Awais, Anjan Dutta2026-06-17