🤖 AI

ARCANA: A Reflective Multi-Agent Program Synthesis Framework for ARC-AGI-2 Reasoning

यह शोध पत्र ARCANA को प्रस्तुत करता है, जो एक सहयोगात्मक मल्टी-एजेंट फ्रेमवर्क है जो कड़े प्रतिबंधों के तहत ARC-AGI-2 कार्यों के लिए तर्क दक्षता और समाधान की गुणवत्ता को बढ़ाता है, जो समस्याओं को एक साझा विभेदी ब्लैकबोर्ड (differentiable blackboard) के माध्यम से समन्वित धारणात्मक ग्राउंडिंग (perceptual grounding), परिकल्पना सृजन (hypothesis generation), प्रतीकात्मक निष्पादन (symbolic execution), और परावर्तित परिशोधन (reflective refinement) के पुनरावृत्ति चक्रों में विभाजित करता है।

Kunbo Zhang, Lei Fu, Zeyu Wang, Zijing Liu, Kejian Tong2026-07-13
🤖 AI

On Locality and Length Generalization in Visual Reasoning

यह शोध पत्र यह प्रदर्शित करता है कि जबकि मानक वैश्विक विज़न मॉडल अक्सर शॉर्टकट का लाभ उठाकर कार्य जटिलता के बीच सामान्यीकरण करने में विफल रहते हैं, कड़ाई से स्थानीय धारणा पर आधारित आवर्ती नीतियां (recurrent policies) इन सीमाओं को पार करने और सुदृढ़ संरचनात्मक सामान्यीकरण (compositional generalization) प्राप्त करने में सक्षम हैं, जो यह सुझाव देता है कि दृश्य तर्क के लिए स्थानीय ध्यान (local attention) आवश्यक है।

Pulkit Madan, Sanjay Haresh, Reza Ebrahimi, Sunny Panchal, Apratim Bhattacharyya, Roland Memisevic2026-07-13
🤖 AI

OmniMapBench: Benchmarking Visual-Centric Reasoning on Diverse Map Documents

OmniMapBench एक नया बेंचमार्क है जिसमें विविध मानचित्र दस्तावेजों में से 2,000 से अधिक मैन्युअल रूप से एनोटेट किए गए प्रश्न-उत्तर जोड़े शामिल हैं, जिसे विजुअल डिपेंडेंसी इंडेक्स को पेश करके अपरिहार्य विजुअल ग्राउंडिंग को मापने और लार्ज विजन-लैंग्वेज मॉडल्स में विजुअल-केंद्रित तर्क को विकसित करने और मूल्यांकन करने के लिए डिज़ाइन किया गया है।

Yang Chen, Yunwen Li, Yufan Shen, Minghao Liu, Tianyu Zheng, Bin Fu, Qunshu Lin, Zhi Yu, Botian Shi2026-07-13
🤖 AI

Neuro-Agentic Control: A Deep Learning-based LLM-Powered Agentic AI Framework for Controlling Security Controls

यह शोध पत्र एक न्यूरो-एजेंटिक कंट्रोल फ्रेमवर्क पेश करता है जो एक LLM-आधारित प्लानर को टाइम-सीरीज फाउंडेशन मॉडल और एक काउंटरफैक्चुअल फिजिक्स इंजेक्शन मैकेनिज्म के साथ जोड़ता है ताकि औद्योगिक IoT वातावरण में साइबर हमलों के विरुद्ध सुरक्षित, भौतिकी-आधारित स्वायत्त रक्षा सक्षम की जा सके, जो असुरक्षित मतिभ्रम (hallucinated) कार्यों को समाप्त करते हुए घुसपैठ को प्रभावी ढंग से रोकता है।

Saroj Gopali, Bipin Chhetri, Deepika Giri, Sima Siami-Namini, Akbar Siami Namin2026-07-13
🤖 AI

L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning

यह शोध पत्र कानूनी तर्क में मल्टी-एजेंट डिबेट संरचनाओं का मूल्यांकन करने के लिए L-MAD ढांचे को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि विशेषज्ञ व्यक्तित्व (expert personas) सौंपने से सटीकता में सुधार होता है, जबकि एक महत्वपूर्ण ट्रेड-ऑफ भी प्रकट होता है जहाँ एजेंटों की बढ़ती संख्या विसंगति को कम करती है लेकिन विस्तारित चर्चा दौर हानिकारक अति-विमर्श विचलन (over-deliberation drift) का कारण बनते हैं।

Tan-Minh Nguyen, Hoang-Trung Nguyen, Huu-Dong Nguyen, Dinh-Truong Do, Thi-Hai-Yen Vuong, Le-Minh Nguyen2026-07-13
🤖 AI

IB-Flow: Information Bottleneck-Guided CFG Distillation for Few-Step Text-to-Image Generation

IB-Flow एक नवीन फ्यू-स्टेप टेक्स्ट-टू-इमेज जनरेशन फ्रेमवर्क है जो स्टैटिक, ब्लाइंड क्लासिफायर-फ्री गाइडेंस डिस्टिलेशन को इंस्टेंस-अवेयर टारगेट सिलेक्शन और एंट्रॉपी-अवेयर स्ट्रेंथ शेड्यूलिंग वाले ड्यूल-ट्रैक अडैप्टिव मैकेनिज्म से बदलने के लिए इंफॉर्मेशन बॉटलनेक सिद्धांत का लाभ उठाता है, जिससे ओवर-कंडीशनिंग आर्टिफैक्ट्स समाप्त हो जाते हैं और केवल दो स्टेप्स में स्टेट-ऑफ-द-आर्ट फिडेलिटी प्राप्त होती है।

Yiting Wang, Jingyi Zhang, Wenhu Zhang, Ke Chao, Yves Liang, Kun Cheng, Kang Zhao2026-07-13
🤖 AI

KV-PRM: Efficient Process Reward Modeling via KV-Cache Transfer for Multi-Agent Test-Time Scaling

KV-PRM एक कुशल प्रोसेस रिवॉर्ड मॉडल है जो टेक्स्ट-आधारित री-एनकोडिंग की कम्प्यूटेशनल बाधा को समाप्त करने के लिए सीधे प्री-कंप्यूटेड KV कैश का लाभ उठाता है ताकि स्कोरिंग जटिलता को O(L²) से घटाकर O(L) किया जा सके, जिससे कई रीजनिंग बेंचमार्क में मौजूदा तरीकों के बराबर या उनसे बेहतर प्रदर्शन करते हुए गति और मेमोरी में भारी लाभ प्राप्त होता है।

Peng Kuang, Haibo Jin, Xiaoyu Han, Yanli Wang, Xiaopeng Yuan, Ye Yu, Kaidi Xu, Haohan Wang2026-07-13
🤖 AI

Scoped Verification for Reliable Long-Horizon Agentic Context Evolution under Distribution Shift

यह शोध पत्र ग्राफ-रेगुलराइज्ड एजेंटिक कॉन्टेक्स्ट इवोल्यूशन (GRACE) प्रस्तुत करता है, जो अपडेट के स्थानीय सत्यापन को सक्षम करने के लिए निरंतर सिस्टम निर्देशों को टाइप किए गए सिमेंटिक ग्राफ के रूप में संरचित करता है, जिससे फ्लैट-टेक्स्ट बेसलाइन की तुलना में डिस्ट्रीब्यूशन शिफ्ट के तहत एलएलएम (LLM) एजेंटों की लॉन्ग-होरिज़न विश्वसनीयता में महत्वपूर्ण सुधार होता है।

Dan C. Hsu, Luke Lu2026-07-13
🔢 mathematics

Generative Communications: Overview, Technologies, and Trends

यह शोध पत्र जेनेरेटिव कम्युनिकेशंस (GenCom) को एक नए 6G प्रतिमान (paradigm) के रूप में प्रस्तुत करता है जहाँ बड़े AI मॉडल अर्थ संबंधी समझ और सामग्री निर्माण को संचालित करते हैं, जो संचार को बिट-दर-बिट ट्रांसमिशन के बजाय नियंत्रित संश्लेषण (controlled synthesis) के रूप में पुनर्परिभाषित करते हैं ताकि अत्यंत कुशल, सुदृढ़ और बुद्धिमान नेटवर्किंग प्राप्त की जा सके।

Wenjun Zhang, Zhiyong Chen, Tong Wu, Guo Lu, Li Song, Feng Yang, Meixia Tao2026-07-13
🔬 materials science

Toward Auditable AI Scientists: A Hypothesis Evolution Protocol for LLM Agents

यह शोध पत्र हाइपोथीसिस इवोल्यूशन प्रोटोकॉल (HEP) को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो लार्ज लैंग्वेज मॉडल एजेंटों को परिकल्पना सृजन, परीक्षण और विश्वास संशोधन के लिए स्पष्ट, ऑडिट योग्य संचालन से सुसज्जित करता है, जिससे पारदर्शी और सत्यापन योग्य एआई-संचालित वैज्ञानिक खोज सक्षम होती है।

Izumi Takahara, Teruyasu Mizoguchi2026-07-13