🤖 AI

The Patchwork Problem in LLM-Generated Code

यह शोध पत्र "पैचवर्क समस्या" (patchwork problem) की पहचान और उसे औपचारिक रूप देता है, जो LLM-जनित कोड में एक संरचनात्मक सुसंगतता विफलता है जहाँ स्थानीय रूप से वैध पैच वैश्विक स्तर पर टूटी हुई प्रणालियाँ बना देते हैं जो मानक परीक्षणों से बच निकलती हैं, और इन महत्वपूर्ण, मॉडल-विशिष्ट दोषों को संबोधित करने के लिए एक हाइब्रिड सत्यापन ढांचे और एक नए विफलता वर्गीकरण का प्रस्ताव करता है।

Viraaji Mothukuri, Reza M. Parizi2026-07-13
🤖 AI

A Formalization of the Mean-Field Derivation of the Vlasov Equation: AI-Assisted Lean Formalization as a Strategy Game

यह शोध पत्र एक केस स्टडी प्रस्तुत करता है जहाँ एक गणितज्ञ एक AI सिस्टम को लीन 4 (Lean 4) में व्लासोव समीकरण (Vlasov equation) के मीन-फील्ड व्युत्पन्न (mean-field derivation) को औपचारिक रूप देने के लिए निर्देशित करता है, जो इस प्रक्रिया को एक "रणनीति खेल" (strategy game) के रूप में फ्रेम करता है जिसने लगभग एक महीने के भीतर सफलतापूर्वक एक पूर्ण, अक्षम-मुक्त (axiom-clean) प्रमाण और एक पुन: प्रयोज्य ऑप्टिमल-ट्रांसपोर्ट लाइब्रेरी का निर्माण किया।

Joseph K. Miller2026-07-13
🤖 machine learning

Model Agnostic Graph Prompt Learning for Crystal Property Prediction

यह शोध पत्र एक मॉडल-अज्ञेय (model-agnostic), हल्का बहु-स्तरीय सॉफ्ट प्रॉम्प्ट लर्निंग फ्रेमवर्क प्रस्तावित करता है जो अव्यक्त स्थानीय रासायनिक अर्थों (latent local chemical semantics) और वैश्विक संरचनात्मक समरूपताओं (global structural symmetries) को कैप्चर करके क्रिस्टल गुण भविष्यवाणी को बढ़ाता है, जिससे मौजूदा ग्राफ न्यूरल नेटवर्क के प्रदर्शन में महत्वपूर्ण सुधार होता है और प्रभावी क्रॉस-प्रॉपर्टी ज्ञान हस्तांतरण सक्षम होता है।

Shrimon Mukherjee, Kishalay Das, Partha Basuchowdhuri, Pawan Goyal, Niloy Ganguly2026-07-13
⚡ electrical engineering

Phone Segmentation and Recognition through Phonological Activation Mapping

यह शोध पत्र SPAM का प्रस्ताव करता है, जो एक ऐसी विधि है जो फोन सेगमेंटेशन और रिकग्निशन दोनों करने के लिए सेल्फ-सुपरवाइज्ड स्पीच मॉडल्स का लाभ उठाती है, जिसमें लेटेंट रिप्रेजेंटेशन्स को लाइटवेट, ग्रेडिएंट-डिसेंट-फ्री हेड्स का उपयोग करके फोनोलॉजिकल फीचर एक्टिवेशन्स पर मैप किया जाता है, जिससे न्यूनतम प्रशिक्षण डेटा के साथ मजबूत प्रदर्शन प्राप्त होता है और अनदेखे फोन्स (unseen phones) के लिए सामान्यीकरण (generalize) संभव होता है।

Shikhar Bharadwaj, Kwanghee Choi, Stephen McIntosh, Chin-Jou Li, Eunjung Yeo, Daisuke Saito, Nobuaki Minematsu, Shinji W (…)2026-07-13
🤖 AI

Video Generation Models are General-Purpose Vision Learners

यह शोध पत्र GenCeption का प्रस्ताव करता है, जो एक प्री-ट्रेंड टेक्स्ट-टू-वीडियो डिफ्यूजन बैकबोन पर निर्मित एक फीड-फॉरवर्ड परसेप्शन मॉडल है, जो यह प्रदर्शित करता है कि बड़े पैमाने पर वीडियो जनरेशन, विविध कंप्यूटर विज़न कार्यों में अत्याधुनिक, डेटा-कुशल और सामान्य-उद्देश्य वाली दृश्य बुद्धिमत्ता प्राप्त करने के लिए एक श्रेष्ठ प्री-ट्रेनिंग प्रतिमान के रूप में कार्य करता है।

Letian Wang, Chuhan Zhang, Rishabh Kabra, Jasper Uijlings, Steven Waslander, Andrew Zisserman, Joao Carreira, Kaiming He (…)2026-07-13
🤖 AI

ARCANA: A Reflective Multi-Agent Program Synthesis Framework for ARC-AGI-2 Reasoning

यह शोध पत्र ARCANA को प्रस्तुत करता है, जो एक सहयोगात्मक मल्टी-एजेंट फ्रेमवर्क है जो कड़े प्रतिबंधों के तहत ARC-AGI-2 कार्यों के लिए तर्क दक्षता और समाधान की गुणवत्ता को बढ़ाता है, जो समस्याओं को एक साझा विभेदी ब्लैकबोर्ड (differentiable blackboard) के माध्यम से समन्वित धारणात्मक ग्राउंडिंग (perceptual grounding), परिकल्पना सृजन (hypothesis generation), प्रतीकात्मक निष्पादन (symbolic execution), और परावर्तित परिशोधन (reflective refinement) के पुनरावृत्ति चक्रों में विभाजित करता है।

Kunbo Zhang, Lei Fu, Zeyu Wang, Zijing Liu, Kejian Tong2026-07-13
🤖 AI

On Locality and Length Generalization in Visual Reasoning

यह शोध पत्र यह प्रदर्शित करता है कि जबकि मानक वैश्विक विज़न मॉडल अक्सर शॉर्टकट का लाभ उठाकर कार्य जटिलता के बीच सामान्यीकरण करने में विफल रहते हैं, कड़ाई से स्थानीय धारणा पर आधारित आवर्ती नीतियां (recurrent policies) इन सीमाओं को पार करने और सुदृढ़ संरचनात्मक सामान्यीकरण (compositional generalization) प्राप्त करने में सक्षम हैं, जो यह सुझाव देता है कि दृश्य तर्क के लिए स्थानीय ध्यान (local attention) आवश्यक है।

Pulkit Madan, Sanjay Haresh, Reza Ebrahimi, Sunny Panchal, Apratim Bhattacharyya, Roland Memisevic2026-07-13
🤖 AI

OmniMapBench: Benchmarking Visual-Centric Reasoning on Diverse Map Documents

OmniMapBench एक नया बेंचमार्क है जिसमें विविध मानचित्र दस्तावेजों में से 2,000 से अधिक मैन्युअल रूप से एनोटेट किए गए प्रश्न-उत्तर जोड़े शामिल हैं, जिसे विजुअल डिपेंडेंसी इंडेक्स को पेश करके अपरिहार्य विजुअल ग्राउंडिंग को मापने और लार्ज विजन-लैंग्वेज मॉडल्स में विजुअल-केंद्रित तर्क को विकसित करने और मूल्यांकन करने के लिए डिज़ाइन किया गया है।

Yang Chen, Yunwen Li, Yufan Shen, Minghao Liu, Tianyu Zheng, Bin Fu, Qunshu Lin, Zhi Yu, Botian Shi2026-07-13
🤖 AI

Neuro-Agentic Control: A Deep Learning-based LLM-Powered Agentic AI Framework for Controlling Security Controls

यह शोध पत्र एक न्यूरो-एजेंटिक कंट्रोल फ्रेमवर्क पेश करता है जो एक LLM-आधारित प्लानर को टाइम-सीरीज फाउंडेशन मॉडल और एक काउंटरफैक्चुअल फिजिक्स इंजेक्शन मैकेनिज्म के साथ जोड़ता है ताकि औद्योगिक IoT वातावरण में साइबर हमलों के विरुद्ध सुरक्षित, भौतिकी-आधारित स्वायत्त रक्षा सक्षम की जा सके, जो असुरक्षित मतिभ्रम (hallucinated) कार्यों को समाप्त करते हुए घुसपैठ को प्रभावी ढंग से रोकता है।

Saroj Gopali, Bipin Chhetri, Deepika Giri, Sima Siami-Namini, Akbar Siami Namin2026-07-13
🤖 AI

L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning

यह शोध पत्र कानूनी तर्क में मल्टी-एजेंट डिबेट संरचनाओं का मूल्यांकन करने के लिए L-MAD ढांचे को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि विशेषज्ञ व्यक्तित्व (expert personas) सौंपने से सटीकता में सुधार होता है, जबकि एक महत्वपूर्ण ट्रेड-ऑफ भी प्रकट होता है जहाँ एजेंटों की बढ़ती संख्या विसंगति को कम करती है लेकिन विस्तारित चर्चा दौर हानिकारक अति-विमर्श विचलन (over-deliberation drift) का कारण बनते हैं।

Tan-Minh Nguyen, Hoang-Trung Nguyen, Huu-Dong Nguyen, Dinh-Truong Do, Thi-Hai-Yen Vuong, Le-Minh Nguyen2026-07-13