💬 NLP

MedCTA: A Benchmark for Clinical Tool Agents

यह शोध पत्र MedCTA प्रस्तुत करता है, जो नैदानिक रूप से सत्यापित, चरण-अंतर्निहित कार्यों पर मेडिकल टूल एजेंटों के मूल्यांकन के लिए एक बेंचमार्क है, जो यह प्रकट करता है कि मजबूत संवेदी क्षमताओं के बावजूद, अत्याधुनिक मल्टीमॉडल मॉडल भी बहु-चरणीय नैदानिक टूल उपयोग में महत्वपूर्ण भंगुरता प्रदर्शित करते हैं।

Tajamul Ashraf, Hyewon Jeong, Fida Mohammad Thoker, Bernard Ghanem2026-06-11
🤖 AI

Ouroboros-Spatial: Closing the Data-Model Loop for Spatial Reasoning

ओरोबोरोस-स्पेशियल (Ouroboros-Spatial) एक स्व-विकसित, क्लोज्ड-लूप प्रशिक्षण ढांचे को पेश करता है जहाँ एक मॉडल अपनी वर्तमान क्षमताओं के अनुरूप स्थानिक तर्क डेटा (spatial reasoning data) को गतिशील रूप से उत्पन्न करने के लिए प्रस्तावक (proposer) और समाधानकर्ता (solver) दोनों के रूप में कार्य करता है, जिससे स्थिर, बड़े पैमाने के डेटासेट की तुलना में काफी कम प्रशिक्षण उदाहरणों के साथ बेंचमार्क पर महत्वपूर्ण प्रदर्शन लाभ प्राप्त होता है।

Enhan Zhao, Wei Wu, Yuanrui Zhang, Xueliang Zhao, Di He2026-06-11
🤖 machine learning

ICA Lens: Interpreting Language Models Without Training Another Dictionary

यह शोध पत्र ICALens को प्रस्तुत करता है, जो एक व्यावहारिक और कुशल वर्कफ़्लो है जो स्पार्स ऑटोएनकोडर्स (sparse autoencoders) को प्रशिक्षित करने की आवश्यकता के बिना, सीधे भाषा मॉडल सक्रियणों (language model activations) से मानव-व्याख्या योग्य दिशाओं को निकालने के लिए अनुकूलित इंडिपेंडेंट कंपोनेंट एनालिसिस (ICA) का लाभ उठाता है, यह प्रदर्शित करते हुए कि ICA मॉडल व्याख्यात्मकता (model interpretability) के लिए एक प्रतिस्पर्धी और पूरक प्रथम लेंस के रूप में कार्य करता है।

Sida Liu, Feijiang Han2026-06-11✓ Author reviewed
🤖 AI

Multi-View In-Cabin Monitoring System for Public Transport Vehicles

यह शोध पत्र सार्वजनिक परिवहन वाहनों के लिए एक मल्टी-व्यू इन-कैबिन मॉनिटरिंग डेटासेट प्रस्तुत करता है, जिसमें 3D एनोटेशन के साथ सिंक्रोनाइज़्ड RGB और डेप्थ इमेज, साथ ही एक कैलिब्रेशन पाइपलाइन और मल्टी-व्यू 3D डिटेक्शन मॉडल का मूल्यांकन करने के लिए बेंचमार्किंग टूल्स शामिल हैं।

Evgeny Gorelik, Kenny Dean Karrow, Fikret Sivrikaya, Sahin Albayrak, Christian Baumann2026-06-11✓ Author reviewed
💬 NLP

Hey Chat, Can You Teach Me? Structuring Socratic Dialogue for Human Learning in the Wild

यह शोध पत्र यह प्रदर्शित करता है कि ट्यूटरिंग को बड़े मॉडलों के साथ असंरचित संवाद पर निर्भर रहने के बजाय, एक हल्के सुदृढीकरण शिक्षण (रीइन्फोर्समेंट लर्निंग) नीति द्वारा हल की जाने वाली पाठ्यक्रम अनुक्रमण समस्या के रूप में स्पष्ट रूप से संरचित करना, विविध विषयों में छात्र महारत की दर और दक्षता में महत्वपूर्ण सुधार करता है।

Sidney Tio, Arunesh Sinha, Pradeep Varakantham2026-06-11
🤖 AI

AnchorEdit: Maintaining Temporal Consistency in Multi-turn Image Editing via Causal Memory

AnchorEdit एक उच्च-रिज़ॉल्यूशन, दीर्घकालिक मल्टी-टर्न इमेज एडिटिंग के लिए पहले ऑटोरेग्रेसिव डिफ्यूजन फ्रेमवर्क को पेश करता है जो विस्तारित इंटरैक्शन अनुक्रमों में पहचान के विचलन (identity drift) और त्रुटि संचय (error accumulation) को प्रभावी ढंग से समाप्त करने के लिए एक तीन-चरणीय प्रशिक्षण पाठ्यक्रम और एक कॉज़ल मेमोरी मैकेनिज्म का उपयोग करता है।

Hang Xu, Xiaoxiao Ma, Guohui Zhang, Yu Hu, Siming Fu, Jie Huang, Lin Song, Haoyang Huang, Nan Duan, Feng Zhao2026-06-11
💬 NLP

Automated Creativity Evaluation of Language Models Across Open-Ended Tasks

यह शोध पत्र एक स्केलेबल, डोमेन-अज्ञेय (domain-agnostic) ढांचे को प्रस्तुत करता है जो विचलित नवीनता (divergent novelty) को मापने के लिए सिमेंटिक एंट्रॉपी को कन्वर्जेंट कार्य पूर्ति (convergent task fulfilment) का आकलन करने वाले रिट्रीवल-आधारित मल्टी-एजेंट जज के साथ जोड़कर, ओपन-एंडेड कार्यों में लार्ज लैंग्वेज मॉडल की रचनात्मकता को परिमाणित करता है।

Min Sen Tan, Zachary Kit Chun Choy, Syed Ali Redha Alsagoff, Nadya Yuki Wangsajaya, Mohor Banerjee, Swaagat Bikash Saiki (…)2026-06-11
⚡ electrical engineering

Fast Speech Foundation Model Distillation Using Interleaved Stacking

यह शोध पत्र "इंटरलीव्ड स्टैकिंग" (interleaved stacking) का प्रस्ताव करता है, जो बड़े स्पीच फाउंडेशन मॉडल्स को डिस्टिल करने के लिए एक नवीन प्रशिक्षण त्वरण विधि है, जो मौजूदा स्टैकिंग तकनीकों में देखी जाने वाली प्रदर्शन गिरावट से बचने के लिए लेयर पोजीशन को सुरक्षित रखते हुए मॉडल की गहराई को प्रगतिशील रूप से बढ़ाती है।

Eungbeom Kim, Kyogu Lee2026-06-11
🤖 AI

When Do Data-Driven Systems Exhibit the Capability to Infer?

यूरोपीय एआई एक्ट (European AI Act) में क्रेडिट स्कोरिंग सिस्टम के संबंध में नियामक अस्पष्टताओं से प्रेरित होकर, यह शोध पत्र पूरे डेटा प्रोसेसिंग वर्कफ़्लो में अनुमान लगाने की क्षमता को ग्रेड और विश्लेषित करने के लिए सांख्यिकीय शिक्षण सिद्धांत (statistical learning theory) पर आधारित एक रूपरेखा प्रस्तावित करता है, जो यह प्रदर्शित करता है कि नियामक वर्गीकरण केवल व्यक्तिगत मॉडलों के बजाय समग्र प्रणाली डिजाइन और मानवीय भागीदारी पर निर्भर करता है।

Maximilian Poretschkin, Tabea Naeven2026-06-11