💻 computer science

AutoRubric-T2I: Robust Rule-Based Reward Model for Text-to-Image Alignment

AutoRubric-T2I एक नवीन ढांचा है जो विजन-लैंग्वेज मॉडल जजों को निर्देशित करने के लिए स्पष्ट और व्याख्या योग्य रूब्रिक्स को स्वचालित रूप से संश्लेषित और चयन करता है, जिससे उच्च व्याख्यात्मकता और बड़े पैमाने पर मानव प्राथमिकता डेटा पर न्यूनतम निर्भरता के साथ टेक्स्ट-टू-इमेज संरेखण (alignment) में अत्याधुनिक परिणाम प्राप्त होते हैं।

Kuei-Chun Kao, Daixuan Huo, Yuanhao Ban, Cho-Jui Hsieh2026-05-19
💻 computer science

GraphMind: From Operational Traces to Self-Evolving Workflow Automation

GraphMind एक एंड-टू-एंड, स्व-विकसित होने वाली प्रणाली है जो एक मल्टी-एजेंट ट्रैवर्सल इंजन और एडेप्टिव ट्रैवर्सल रीइन्फोर्समेंट का उपयोग करके ऑपरेशनल ट्रेसेस से स्वतः ही एक्शन-केंद्रित वर्कफ़्लो ग्राफों का निर्माण, निष्पादन और अनुकूलन करती है, जो एंटरप्राइज इंसिडेंट इन्वेस्टिगेशन में बेसलाइन विधियों से काफी बेहतर प्रदर्शन करती है।

Yiwen Zhu, Joyce Cahoon, Anna Pavlenko, Qiushi Bai, Nima Shahbazi, Divya Vermareddy, Meina Wang, Mathieu Demarne, Swati (…)2026-05-19
💻 computer science

Prediction of Challenging Behaviors Associated with Profound Autism in a Classroom Setting Using Wearable Sensors

यह अध्ययन प्रदर्शित करता है कि फाइन-ट्यून्ड फाउंडेशन मॉडल्स, एक वास्तविक विशेष शिक्षा कक्षा में नौ व्यक्तियों से एकत्र किए गए मल्टीमॉडल वियरेबल सेंसर डेटा का विश्लेषण करके, 0.78 के AUC-ROC के साथ गंभीर ऑटिज्म (profound autism) में चुनौतीपूर्ण व्यवहारों की 10 मिनट पहले तक भविष्यवाणी कर सकते हैं, जो सक्रिय सुरक्षा हस्तक्षेपों के लिए मार्ग प्रशस्त करता है।

Yadhu Kartha, Conor Anderson, Jenny Foster, Theresa Hamlin, Johanna Lantz, Ryan Lay, Juergen Hahn, Gari D. Clifford, Hye (…)2026-05-19
💻 computer science

SynVA: A Modular Toolkit for Vessel Generation and Aneurysm Editing

यह शोध पत्र SynVA को प्रस्तुत करता है, जो एक मॉड्यूलर टूलकिट है जो बड़े पैमाने पर, शारीरिक रूप से सुसंगत सिंथेटिक इंट्राक्रैनील एन्यूरिज्म डेटासेट उत्पन्न करने के लिए फ्लो-मैचिंग और प्रक्रियात्मक विधियों को जोड़ता है, जिससे सेरेब्रोवैस्कुलर अनुसंधान में डीप लर्निंग मॉडल को प्रशिक्षित करने के लिए डेटा की कमी को दूर किया जा सके।

Marten J. Finck, Niklas C. Koser, Sarker M. Mahfuz, Tameem Jahangir, Jon E. Wilhelm, Daniel Behme, Naomi Larsen, Wojtek (…)2026-05-19
💻 computer science

SparseSAM: Structured Sparsification of Activations in Segment Anything Models

SparseSAM एक प्रशिक्षण-मुक्त (training-free) फ्रेमवर्क है जो स्ट्राइप-सॉर्ट अटेंशन (Stripe-Sort Attention) और एक रेसिडुअल-कंसिस्टेंसी एमएलपी (Residual-Consistency MLP) को पेश करके सेगमेंट एनीथिंग मॉडल्स (Segment Anything Models) को त्वरित करता है, जिससे मौजूदा विधियों की तुलना में न्यूनतम सटीकता हानि के साथ महत्वपूर्ण इन्फरेंस स्पीडअप और मेमोरी में कमी प्राप्त होती है।

Hoai-Chau Tran, Chi H. Nguyen, Duy M. H. Nguyen, Mathias Niepert, Fan Lai, Khoa D. Doan2026-05-19
💻 computer science

SAPO: Step-Aligned Policy Optimization for Reasoning-Based Generative Recommendation

SAPO (Step-Aligned Policy Optimization) वैश्विक परिणाम पुरस्कारों (global outcome rewards) को स्टेप-अलाइन्ड, ग्रुप-रिलेटिव एडवांटेज से बदलकर जनरेटिव रिकमेंडेशन को बेहतर बनाता है, जो व्यक्तिगत रीजनिंग स्टेप्स और उनके संबंधित सिमेंटिक आइडेंटिफायर टोकन्स को क्रेडिट असाइन करता है, जिससे बड़े-कैटलॉग वाले परिदृश्यों में प्रशिक्षण को स्थिर करने और प्रदर्शन में सुधार करने में मदद मिलती है जहाँ सटीक-मैच फीडबैक अपर्याप्त होता है।

Zaiyi Zheng, Guanghui Min, Yaochen Zhu, Liang Wu, Liangjie Hong, Chen Chen, Jundong Li2026-05-19
🤖 machine learning

LLMForge: Multi-Backend Hardware-Aware Neural Architecture Search with Infinite-Head Attention for Edge Language Models

LLMForge एक हार्डवेयर-जागरूक न्यूरल आर्किटेक्चर सर्च फ्रेमवर्क है जो विशिष्ट एज डिवाइस बाधाओं के अनुरूप अनुकूलित सब-बिलियन-पैरामीटर लैंग्वेज मॉडल्स को स्वचालित रूप से उत्पन्न करने के लिए इनफिनिट-हेड अटेंशन और एक मल्टी-बैकएंड कॉस्ट मॉडल का लाभ उठाता है, जो मौजूदा बेसलाइनों की तुलना में ऊर्जा दक्षता, लेटेंसी और मॉडल सटीकता में महत्वपूर्ण सुधार प्राप्त करता है।

Xinting Jiang, Junyi Luo, Ruichen Qi, Kauna Lei, Ben Laurie, Gregory Kielian, Mehdi Saligane2026-05-19
📊 statistics

Training Infinitely Deep and Wide Transformers

यह शोध पत्र उनके गतिकी को एक न्यूरल PDE के रूप में मॉडल करके, फॉरवर्ड और बैकवर्ड पास की सुव्यवस्थितता (well-posedness) को सिद्ध करते हुए और यह प्रदर्शित करते हुए कि न्यूरल टेंगेंट कर्नेल (Neural Tangent Kernel) की इंजेक्टिविटी की विशिष्ट स्थितियों के तहत ग्रेडिएंट फ्लो वैश्विक न्यूनतम (global minima) की ओर अभिसरित होता है, मीन-फील्ड रिजीम में अनंत रूप से गहरे और चौड़े ट्रांसफॉर्मर्स को प्रशिक्षित करने के लिए एक कठोर गणितीय ढांचा स्थापित करता है।

Raphaël Barboni, Maarten V. de Hoop, Takashi Furuya, Gabriel Peyré2026-05-19
💻 computer science

Multimodal Cultural Heritage Knowledge Graph Extension with Language and Vision Models

यह शोध पत्र WJoconde, जो कि एक मल्टीमॉडल फ्रांसीसी सांस्कृतिक विरासत ज्ञान ग्राफ है, को प्रस्तुत करता है और एक विशेष सत्यापन पाइपलाइन के माध्यम से उच्च विश्वसनीयता के साथ ऐसे ग्राफों को स्वचालित रूप से विस्तारित करने के लिए लार्ज लैंग्वेज मॉडल्स और विजन-लैंग्वेज मॉडल्स का लाभ उठाने वाला एक नवीन ढांचा प्रस्तावित करता है।

Yang Zhang, Nada Mimouni, Jean-Claude Moissinac, Fayçal Hamdi2026-05-19
🤖 machine learning

PEIRA: Learning Predictive Encoders through Inter-View Regressor Alignment

यह शोध पत्र PEIRA को प्रस्तुत करता है, जो एक नॉन-कॉन्ट्रास्टिव सेल्फ-सुपरवाइज्ड लर्निंग विधि है जो एक इष्टतम लीनियर रिग्रेसर के ट्रेस (trace) के माध्यम से एक सुपरिभाषित उद्देश्य स्थापित करती है ताकि स्थिर, नॉन-कोलैप्स्ड ट्रेनिंग डायनेमिक्स सुनिश्चित किया जा सके जो अग्रणी नॉनलीनियर कैनोनिकल कोरिलेशन सबस्पेस के साथ संरेखित हो, जिससे ImageNet-1K और CIFAR-10 पर प्रतिस्पर्धी प्रदर्शन प्राप्त होता है।

Michael Arbel, Basile Terver, Jean Ponce2026-05-19