🤖 machine learning

Eluna: An Agentic LLM System for Automating Warehouse Operations with Reasoning and Task Execution

यह शोध पत्र एलुना (Eluna) का परिचय देता है, जो एक प्रोडक्शन-डिप्लॉयड एजेंटिक सिस्टम है जो मानक संचालन प्रक्रियाओं (SOPs) को ग्राफ-गाइडेड मल्टी-एजेंट वर्कफ़्लो में एनकोड करके और उच्च सटीकता तथा कम विलंबता (लो लेटेंसी) प्राप्त करने के लिए एसिमेट्रिक एपिसोडिक डिस्टिलेशन (asymmetric episodic distillation) का उपयोग करके, बिना इन्फरेंस-टाइम ओवरहेड के जटिल वेयरहाउस ऑपरेशन्स को स्वचालित करता है।

Ning Liu, Kalle Kujanpää, Zhaoxuan Zhu, P Aditya Sreekar, Kaiwen Liu, Chuanneng Sun, Jorge Marchena Menendez, Matthew Ba (…)2026-07-13
📊 statistics

NL-PAC: Specification Ambiguity and Certified Minimax Risk Floors in LLM-Mediated Supervision

यह शोधपत्र नेचुरल लैंग्वेज PAC (NL-PAC) प्रस्तुत करता है, जो एक ऐसा ढांचा है जो विनिर्देश अस्पष्टता (specification ambiguity) के कारण LLM-मध्यस्थ पर्यवेक्षण में उत्पन्न होने वाले एक मौलिक मिनिमैक्स जोखिम फ्लोर (minimax risk floor) को परिमाणित और प्रमाणित करता है, यह प्रदर्शित करते हुए कि अतिरिक्त लेबल उन पहचान समस्याओं (identification problems) को हल नहीं कर सकते जब परिचालन संबंधी व्याख्या छिपी रहती है।

Berkay Anahtarci2026-07-13
🤖 AI

Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading

यह शोधपत्र Long-Horizon-Terminal-Bench प्रस्तुत करता है, जो एक नया बेंचमार्क है जिसमें सघन, सूक्ष्म-स्तरीय रिवॉर्ड ग्रेडिंग के साथ 46 जटिल, बहु-घंटे के टर्मिनल कार्य शामिल हैं ताकि लॉन्ग-होराइजन प्लानिंग और इटरेटिव प्रॉब्लम-सॉल्विंग में वर्तमान एआई एजेंटों की महत्वपूर्ण सीमाओं का बेहतर मूल्यांकन और प्रदर्शन किया जा सके।

Zongxia Li, Zhongzhi Li, Yucheng Shi, Ruhan Wang, Junyao Yang, Zhichao Liu, Xiyang Wu, Anhao Li, Yue Yu, Ninghao Liu, Li (…)2026-07-13
🤖 AI

MultiView-Bench: A Diagnostic Benchmark for World-Centric Multi-View Integration in VLMs

यह शोध पत्र MultiView-Bench प्रस्तुत करता है, जो एक नैदानिक बेंचमार्क है जो यह प्रकट करता है कि अत्याधुनिक विजन-लैंग्वेज मॉडल मल्टी-व्यू अवलोकनों को एक सुसंगत विश्व-केंद्रित 3D मॉडल में एकीकृत करने में संघर्ष करते हैं, और ViewNavigator प्रस्तावित करता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो सूचनात्मक दृष्टिकोणों को सक्रिय रूप से चुनने और संलयित करने द्वारा प्रदर्शन में महत्वपूर्ण सुधार करता है।

Hantao Zhang, Jinru Sui, Ed Li, Dirk Bergemann, Zhuoran Yang2026-07-13
🤖 AI

The Patchwork Problem in LLM-Generated Code

यह शोध पत्र "पैचवर्क समस्या" (patchwork problem) की पहचान और उसे औपचारिक रूप देता है, जो LLM-जनित कोड में एक संरचनात्मक सुसंगतता विफलता है जहाँ स्थानीय रूप से वैध पैच वैश्विक स्तर पर टूटी हुई प्रणालियाँ बना देते हैं जो मानक परीक्षणों से बच निकलती हैं, और इन महत्वपूर्ण, मॉडल-विशिष्ट दोषों को संबोधित करने के लिए एक हाइब्रिड सत्यापन ढांचे और एक नए विफलता वर्गीकरण का प्रस्ताव करता है।

Viraaji Mothukuri, Reza M. Parizi2026-07-13
🤖 AI

A Formalization of the Mean-Field Derivation of the Vlasov Equation: AI-Assisted Lean Formalization as a Strategy Game

यह शोध पत्र एक केस स्टडी प्रस्तुत करता है जहाँ एक गणितज्ञ एक AI सिस्टम को लीन 4 (Lean 4) में व्लासोव समीकरण (Vlasov equation) के मीन-फील्ड व्युत्पन्न (mean-field derivation) को औपचारिक रूप देने के लिए निर्देशित करता है, जो इस प्रक्रिया को एक "रणनीति खेल" (strategy game) के रूप में फ्रेम करता है जिसने लगभग एक महीने के भीतर सफलतापूर्वक एक पूर्ण, अक्षम-मुक्त (axiom-clean) प्रमाण और एक पुन: प्रयोज्य ऑप्टिमल-ट्रांसपोर्ट लाइब्रेरी का निर्माण किया।

Joseph K. Miller2026-07-13
🤖 machine learning

Model Agnostic Graph Prompt Learning for Crystal Property Prediction

यह शोध पत्र एक मॉडल-अज्ञेय (model-agnostic), हल्का बहु-स्तरीय सॉफ्ट प्रॉम्प्ट लर्निंग फ्रेमवर्क प्रस्तावित करता है जो अव्यक्त स्थानीय रासायनिक अर्थों (latent local chemical semantics) और वैश्विक संरचनात्मक समरूपताओं (global structural symmetries) को कैप्चर करके क्रिस्टल गुण भविष्यवाणी को बढ़ाता है, जिससे मौजूदा ग्राफ न्यूरल नेटवर्क के प्रदर्शन में महत्वपूर्ण सुधार होता है और प्रभावी क्रॉस-प्रॉपर्टी ज्ञान हस्तांतरण सक्षम होता है।

Shrimon Mukherjee, Kishalay Das, Partha Basuchowdhuri, Pawan Goyal, Niloy Ganguly2026-07-13
⚡ electrical engineering

Phone Segmentation and Recognition through Phonological Activation Mapping

यह शोध पत्र SPAM का प्रस्ताव करता है, जो एक ऐसी विधि है जो फोन सेगमेंटेशन और रिकग्निशन दोनों करने के लिए सेल्फ-सुपरवाइज्ड स्पीच मॉडल्स का लाभ उठाती है, जिसमें लेटेंट रिप्रेजेंटेशन्स को लाइटवेट, ग्रेडिएंट-डिसेंट-फ्री हेड्स का उपयोग करके फोनोलॉजिकल फीचर एक्टिवेशन्स पर मैप किया जाता है, जिससे न्यूनतम प्रशिक्षण डेटा के साथ मजबूत प्रदर्शन प्राप्त होता है और अनदेखे फोन्स (unseen phones) के लिए सामान्यीकरण (generalize) संभव होता है।

Shikhar Bharadwaj, Kwanghee Choi, Stephen McIntosh, Chin-Jou Li, Eunjung Yeo, Daisuke Saito, Nobuaki Minematsu, Shinji W (…)2026-07-13
🤖 AI

Video Generation Models are General-Purpose Vision Learners

यह शोध पत्र GenCeption का प्रस्ताव करता है, जो एक प्री-ट्रेंड टेक्स्ट-टू-वीडियो डिफ्यूजन बैकबोन पर निर्मित एक फीड-फॉरवर्ड परसेप्शन मॉडल है, जो यह प्रदर्शित करता है कि बड़े पैमाने पर वीडियो जनरेशन, विविध कंप्यूटर विज़न कार्यों में अत्याधुनिक, डेटा-कुशल और सामान्य-उद्देश्य वाली दृश्य बुद्धिमत्ता प्राप्त करने के लिए एक श्रेष्ठ प्री-ट्रेनिंग प्रतिमान के रूप में कार्य करता है।

Letian Wang, Chuhan Zhang, Rishabh Kabra, Jasper Uijlings, Steven Waslander, Andrew Zisserman, Joao Carreira, Kaiming He (…)2026-07-13
🤖 AI

ARCANA: A Reflective Multi-Agent Program Synthesis Framework for ARC-AGI-2 Reasoning

यह शोध पत्र ARCANA को प्रस्तुत करता है, जो एक सहयोगात्मक मल्टी-एजेंट फ्रेमवर्क है जो कड़े प्रतिबंधों के तहत ARC-AGI-2 कार्यों के लिए तर्क दक्षता और समाधान की गुणवत्ता को बढ़ाता है, जो समस्याओं को एक साझा विभेदी ब्लैकबोर्ड (differentiable blackboard) के माध्यम से समन्वित धारणात्मक ग्राउंडिंग (perceptual grounding), परिकल्पना सृजन (hypothesis generation), प्रतीकात्मक निष्पादन (symbolic execution), और परावर्तित परिशोधन (reflective refinement) के पुनरावृत्ति चक्रों में विभाजित करता है।

Kunbo Zhang, Lei Fu, Zeyu Wang, Zijing Liu, Kejian Tong2026-07-13