🤖 AI

Unification of Closed-Open Industrial Detection Scenarios: New Large-Scale Benchmarks,Challenges and Baselines

यह शोध पत्र MMIOC-1M प्रस्तुत करता है, जो ओपन-वोकेबुलरी और क्लोज्ड-सेट इंडस्ट्रियल डिफेक्ट डिटेक्शन दोनों के लिए पहला बड़े पैमाने का एकीकृत बेंचमार्क है, और RTVP-Net का प्रस्ताव करता है, जो एक नवीन नेटवर्क है जिसमें विशेषज्ञ-सहायता प्राप्त डोमेन प्रोजेक्शन, ऊर्जा-आधारित स्पार्स सैंपलिंग और द्विदिश टेक्स्ट-विजुअल इंटरैक्शन शामिल है ताकि मैनुअल प्रॉम्प्ट निर्भरता को समाप्त करते हुए अत्याधुनिक प्रदर्शन प्राप्त किया जा सके।

Zekai Zhang, Jinglin Zhang, Qinghui Chen, Gang Li, Da Chen, Shuainan Jing, He Wang, Dagang Li, Cong Liu, Cong Bai, Sheng (…)2026-06-09
💻 computer science

Minibatch Selection via Partition Matroid Constrained Gradient Matching

यह शोधपत्र PartitionSel का प्रस्ताव करता है, जो बड़े भाषा मॉडलों (large language models) को फाइन-ट्यून करने के लिए एक क्रॉस-डोमेन मिनीबैच चयन विधि है, जो अभिसरण गति (convergence speed) और डोमेन कवरेज को संतुलित करने के लिए पार्टीशन-मैट्रॉइड कन्सट्रेंड ग्रेडिएंट मैचिंग (partition-matroid constrained gradient matching) का उपयोग करता है, जिससे ग्रेडिएंट संघर्षों को कम किया जा सके और मौजूदा बेसलाइन की तुलना में प्रदर्शन में सुधार किया जा सके।

Prayas Agrawal, Prateek Chanda, Ishita Khatri, Ganesh Ramakrishnan, Bamdev Mishra, Pratik Jawanpuria2026-06-09
💻 computer science

PRISM: PRior-guided Imagination Sampling in world Models

PRISM एक हल्का, कार्य-अज्ञेय (task-agnostic) ढांचा है जो एक फ्रोजन JEPA-शैली के वर्ल्ड मॉडल से सीधे स्टेट-कंडीशन्ड एक्शन प्रायर्स (state-conditioned action priors) निकालकर और उन्हें पैरामीटर-मुक्त प्रोडक्ट-ऑफ-गॉसियन्स अपडेट के माध्यम से सैंपलिंग प्रक्रिया में एकीकृत करके निरंतर नियंत्रण नियोजन (continuous control planning) को बढ़ाता है, जो बिना किसी आर्किटेक्चरल ब्लोट या इन्फरेंस ओवरहेड के सफलता दर में महत्वपूर्ण सुधार करता है।

Yuhai Wang, Jiawei Xia, Rongxuan Zhou, Xiao Hu, Yongliang Shi, Jing Du, Yang Ye2026-06-09
🤖 AI

VATS: Exploiting Implicit Authority in Error-Path Injection via Systematic Mutation

यह शोध पत्र VATS प्रस्तुत करता है, जो एक म्यूटेशन-संचालित ढांचा है जो यह प्रदर्शित करता है कि स्वायत्त एजेंट "एरर-पाथ इंजेक्शन" के प्रति गंभीर रूप से संवेदनशील हैं, जहाँ टूल एरर संदेशों में अंतर्निहित प्रतिकूल पेलोड सुरक्षा ह्यूरिस्टिक्स को बायपास करने और मानक इनडायरेक्ट प्रॉम्प्ट इंजेक्शन की तुलना में काफी उच्च हमले की सफलता दर प्राप्त करने के लिए एरर कॉन्टेक्स्ट में मॉडलों के निहित विश्वास का फायदा उठाते हैं।

Harshil Patel, Kunal Pai2026-06-09
🤖 machine learning

Enhancing AI Interpretability and Safety through Localised Architectures

यह शोध पत्र यह तर्क देता है कि स्केलेबल, अपारदर्शी डीप न्यूरल नेटवर्क से GPU क्लस्टर्स से हटकर कम बैंडविड्थ लेकिन उच्च प्रति-नोड अभिव्यंजना (expressivity) वाले स्थानीयकृत हार्डवेयर आर्किटेक्चर की ओर संक्रमण, विशेष रूप से छोटे डेटासेट्स के लिए, AI मॉडल्स की व्याख्यात्मकता, सुरक्षा और कम्प्यूटेशनल दक्षता को मौलिक रूप से बढ़ा सकता है।

Ian Seet, Jonas Bozenhard, Simon Osterman2026-06-09
🤖 AI

Efficient Skill Grounding via Code Refactoring with Small Language Models

यह शोध पत्र RECENT को प्रस्तुत करता है, जो एक रिफैक्टरिंग-केंद्रित ढांचा (framework) है जो छोटे भाषा मॉडलों को पूर्ण पुनर्जनन (full regeneration) के बजाय स्थानीयकृत कोड संशोधनों के माध्यम से सिमेंटिक इंटेंट (semantic intent) को निष्पादन बाइंडिंग्स (execution bindings) से अलग करके, एम्बोडीड एजेंटों में मजबूत, लॉन्ग-होरिज़ॉन स्किल ग्राउंडिंग सक्षम बनाता है।

Sera Choi, Wonje Choi, Saehun Chun, Daehee Lee, Jooyoung Kim, Chaeun Lee, Honguk Woo2026-06-09
💬 NLP

Summarization is Not Dead Yet

इस दावे के बावजूद कि बड़े भाषा मॉडल (LLMs) सारांश बनाने की क्षमता में मानव क्षमताओं से आगे निकल गए हैं, एक व्यापक मल्टी-ट्रैक मूल्यांकन से पता चलता है कि जहाँ LLMs प्रवाह और सुसंगतता में उत्कृष्ट हैं, वहीं मानव-लिखित संदर्भ सूचनात्मकता, निष्ठा और तथ्यात्मक विश्वसनीयता में बेहतर बने हुए हैं।

Dongqi Liu, Chenxi Whitehouse, Zheng Zhao, Zhuchen Cao, Jian Li, Yabiao Wang2026-06-09
💬 NLP

Rewrite to Translate, Translate to Reward: Reinforcement Learning for Source Rewriting in Machine Translation

यह शोध पत्र RLSR को प्रस्तुत करता है, जो एक सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो विशिष्ट अनुवाद मॉडलों के लिए मैन्युअल प्रॉम्प्ट ट्यूनिंग की आवश्यकता के बिना, सीधे डाउनस्ट्रीम मशीन अनुवाद गुणवत्ता को अनुकूलित करने के लिए स्रोत पुनर्लेखन (source rewriting) मॉडलों को प्रशिक्षित करता है।

Boxuan Lyu, Haiyue Song, Zhi Qu, Hidetaka Kamigaito, Kotaro Funakoshi, Manabu Okumura2026-06-09
💻 computer science

IEA: Amateur-Friendly Conversational Image Editing Agent via Three Stages of Multitask Alignment

यह शोध पत्र IEA को प्रस्तुत करता है, जो एक संवादात्मक इमेज एडिटिंग एजेंट है जिसे तीन-चरणीय मल्टीटास्क अलाइनमेंट पाइपलाइन के माध्यम से प्रशिक्षित किया गया है जो पारदर्शी और व्याख्या योग्य संपादन उत्पन्न करने के लिए पैरामीटराइज्ड टूल्स का लाभ उठाता है, और मौजूदा जनरेटिव और टूल-कॉलिंग विधियों की तुलना में बेहतर इंस्ट्रक्शन फॉलोइंग और संवेदी गुणवत्ता प्राप्त करता है।

Zichen Zhu, Yuheng Sun, Mingxuan Zhu, Wenjie Ma, Situo Zhang, Zhexiang Wang, Ziyue Yang, Danyang Zhang, Kunyao Lan, Ziha (…)2026-06-09
🤖 AI

UniQL: Towards Dialect-Universal Benchmarking for Text-to-SQL

यह शोध पत्र UniQL को प्रस्तुत करता है, जो 16 डायलेक्ट्स (dialects) में 24,544 निष्पादन योग्य (executable) SQL क्वेरीज़ के साथ संरेखित 1,534 प्राकृतिक भाषा के प्रश्नों वाला एक मानव-सत्यापित बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान टेक्स्ट-टू-SQL मॉडल SQLite से परे सामान्यीकरण करने में संघर्ष करते हैं और डायलेक्ट-जागरूक मूल्यांकन विधियों की महत्वपूर्ण आवश्यकता पर प्रकाश डालता है।

Jianling Gao, Chongyang Tao, Jiayuan Bai, Liu Yang, Xuanguang Pan, Jinrui Liu, Shihao Xing, Xiaohan Xu, Jie Liang, Shuai (…)2026-06-09