🤖 AI

Representation Learning Enables Scalable Multitask Deep Reinforcement Learning

यह शोध पत्र तर्क देता है कि मॉडल-आधारित योजना (model-based planning) के बजाय प्रतिनिधित्व शिक्षण (representation learning), स्केलेबल मल्टीटास्क सुदृढीकरण शिक्षण (multicast reinforcement learning) का प्राथमिक चालक है, जो प्रस्तावित MR.Q एल्गोरिदम का प्रदर्शन करता है—जो एक मॉडल-मुक्त एक्टर-क्रिटिक फ्रेमवर्क में प्रेडिक्टिव रिप्रेजेंटेशन को उच्च-क्षमता वाले वैल्यू फंक्शन एप्रोक्सिमेशन के साथ जोड़ता है—जो विविध निरंतर नियंत्रण कार्यों (continuous control tasks) में जटिल वर्ल्ड-मॉडल बेसलाइनों से बेहतर प्रदर्शन करता है और साथ ही कंप्यूटेशनल ओवरहेड को महत्वपूर्ण रूप से कम करता है।

Johan Obando-Ceron, Lu Li, Scott Fujimoto, Pierre-Luc Bacon, Aaron Courville, Pablo Samuel Castro2026-06-05
💬 NLP

InfoShield: Privacy-Preserving Speech Representations for Mental Health Screening via Information-Theoretic Optimization

InfoShield एक नवीन ढांचा है जो स्पीच रिप्रजेंटेशन्स और संवेदनशील गुणों के बीच म्यूचुअल इंफॉर्मेशन को कम करने के लिए क्रॉस-मोडल अटेंशन के साथ एक TimeAwareMINE एस्टीमेटर का लाभ उठाता है, जिससे डिप्रेशन डिटेक्शन में उच्च सटीकता बनाए रखते हुए जनसांख्यिकीय अनुमान (demographic inference) के विरुद्ध गोपनीयता को महत्वपूर्ण रूप से बढ़ाया जाता है।

Xueyang Wu, Siyuan Liu, Kezhuo Yang, Guang Ling2026-06-05
🤖 AI

GuardNet: Ensemble Strategies of Shallow Neural Networks for Robust Prompt Injection and Jailbreak Detection

गार्डनेट (GuardNet) एक हल्का, कम-विलंबता वाला गार्डरेल सिस्टम है जो प्रतिस्पर्धी प्रॉम्प्ट इंजेक्शन और जेलब्रेक डिटेक्शन प्रदर्शन प्राप्त करने के लिए शैलो न्यूरल नेटवर्क के एक एंसेम्बल का उपयोग करता है, जो कुशल उत्पादन परिनियोजन के लिए बड़े मॉडल के पैमाने के बजाय उदाहरण विविधता और थ्रेशोल्ड अंशांकन को प्राथमिकता देता है।

Paulo Ricardo Ferreira Neves, Edson Rodrigues da Cruz Filho, Paulo Henrique Eleuterio Falsetti, João Vitor Pavan, Ian De (…)2026-06-05
💬 NLP

TensorBench: Benchmarking Coding Agents on a Compiler-Based Tensor Framework

TensorBench एक PyTorch-विस्तारित टेंसर फ्रेमवर्क पर कोडिंग एजेंटों के मूल्यांकन के लिए एक विश्वसनीय, कंपाइलर-आधारित बेंचमार्क पेश करता है, जो स्वचालित परीक्षण सूचियों द्वारा ग्रेड किए गए 199 रिपॉजिटरी-स्तरीय कार्यों के माध्यम से, फ्रंटियर मॉडलों के बीच महत्वपूर्ण प्रदर्शन अंतराल और कम टास्क ओवरलैप को प्रकट करता है।

Bobby Yan, Fredrik Kjolstad2026-06-05
🤖 AI

HDST-GNN: Heterogeneous Dynamic Spatiotemporal Graph Neural Networks for Multi-Object Tracking in UAV Aerial Imagery

यह शोध पत्र HDST-GNN का प्रस्ताव करता है, जो एक हेटेरोजेनियस डायनेमिक स्पैटियोटेम्पोरल ग्राफ न्यूरल नेटवर्क है जो ऊंचाई-अनुकूली एज निर्माण (altitude-adaptive edge construction), विभिन्न ऑब्जेक्ट अवस्थाओं के लिए हेटेरोजेनियस नोड रिप्रजेंटेशन और ऑक्लूजन-गेटेड टेम्पोरल एग्रीगेशन को पेश करके UAV-आधारित मल्टी-ऑब्जेक्ट ट्रैकिंग की चुनौतियों का समाधान करता है, जिससे VisDrone2019-MOT डेटासेट पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Phillip Jiang2026-06-05
🤖 AI

Fix the Mind, Not the Move: Interpretable AI Assistance via Knowledge-Gap Localization

यह शोधपत्र SENSEI को प्रस्तुत करता है, जो एक व्याख्यात्मक (interpretable) AI फ्रेमवर्क है जो केवल तात्कालिक कार्यों को सुधारने के बजाय लक्षित सुझावों के माध्यम से अंतर्निहित उपयोगकर्ता की गलत धारणाओं को स्थानीयकृत और संशोधित करके दीर्घकालिक मानव-AI सहयोग में सुधार करता है, जिससे विविध कार्यों में ज़ीरो-शॉट सामान्यीकरण (zero-shot generalization) में उच्च सफलता दर प्राप्त होती है।

Ayano Hiranaka, Ya-Chuan Hsu, Stefanos Nikolaidis, Erdem Bıyık, Daniel Seita2026-06-05
🤖 AI

The End of Software Engineering: How AI Agents Are Fundamentally Restructuring the Software Paradigm

यह शोध पत्र तर्क देता है कि एआई (AI) एजेंटों का उदय सॉफ्टवेयर प्रतिमान के एक मौलिक पुनर्गठन का प्रतिनिधित्व करता है, जो स्थिर, मानव-लिखित कोड से गतिशील, एलएलएम (LLM)-संचालित रीजनिंग लूप की ओर स्थानांतरित हो रहा है और स्व-विकसित एजेंट पारिस्थित प्रणालियों की ओर संक्रमण को नेविगेट करने के लिए "एजेंटिक इंजीनियरिंग" के एक नए अनुशासन को आवश्यक बनाता है।

Zhenfeng Cao2026-06-05
🤖 AI

SlotGCG: Exploiting the Positional Vulnerability in LLMs for Jailbreak Attacks

यह शोध पत्र SlotGCG को प्रस्तुत करता है, जो एक नवीन जेलब्रेक हमला ढांचा (framework) है जो प्रतिकूल टोकन (adversarial token) प्रविष्टि के लिए सबसे संवेदनशील प्रॉम्प्ट "स्लॉट्स" की पहचान करके और उन्हें लक्षित करके लार्ज लैंग्वेज मॉडल्स में स्थितिजन्य कमजोरियों (positional vulnerabilities) का लाभ उठाता है, जिससे यह हमला सफलता दर, अभिसरण गति (convergence speed) और सुरक्षा प्रणालियों के विरुद्ध मजबूती के मामले में GCG जैसे मौजूदा तरीकों से काफी बेहतर प्रदर्शन करता है।

Seungwon Jeong, Jiwoo Jeong, Hyeonjin Kim, Yunseok Lee, Woojin Lee2026-06-05
💬 NLP

When New Generators Arrive: Lifelong Machine-Generated Text Attribution via Ridge Feature Transfer

यह शोध पत्र RidgeFT का प्रस्ताव करता है, जो एक हल्का, रिप्ले-मुक्त ढांचा है जो एक बार टास्क-अवेयर एनकोडर को प्रशिक्षित करने के बाद क्लास-वाइज पर्याप्त सांख्यिकी (sufficient statistics) पर क्लोज्ड-फॉर्म रिज रिग्रेशन का उपयोग करके, पिछले जनरेटरों के ज्ञान को बनाए रखते हुए नए जनरेटर्स के अनुकूल होने को प्रभावी ढंग से संतुलित करते हुए लाइफलॉग मशीन-जेनरेटेड टेक्स्ट एट्रिब्यूशन प्राप्त करता है।

Zhen Sun, Yifan Liao, Zhicong Huang, Jiaheng Wei, Cheng Hong, Yutao Yue, Xinlei He2026-06-05