🤖 AI

FlowSteer: Towards Agents Designing Agentic Workflows via Reinforced Progressive Canvas Editing

FlowSteer एक नवीन ढांचा है जो एक सुदृढ़ प्रोग्रेसिव कैनवस एडिटिंग प्रतिमान (paradigm) के माध्यम से एक एकल एजेंट को वास्तविक समय की ग्राफ-स्तरीय प्रतिक्रिया का लाभ उठाते हुए निष्पादन योग्य एजेंटिक वर्कफ्लो को एंड-टू-एंड डिजाइन करने में सक्षम बनाता है, ताकि मानव-निर्भर निर्माण और इन-लूप त्रुटि सुधार की चुनौतियों पर विजय प्राप्त की जा सके।

Mingda Zhang, Wenjin Liu, Tiesunlong Shen, Qika Lin, Rui Mao, Erik Cambria, Xiaoying Tang, Haoran Luo2026-05-15
💻 computer science

Dynamic Mixed-Precision Routing for Efficient Multi-step LLM Interaction

यह शोध पत्र डायनेमिक मिक्स्ड-प्रिसिजन रूटिंग (DMR) का प्रस्ताव करता है, जो एक दो-चरणीय प्रशिक्षण पाइपलाइन का उपयोग करके प्रत्येक निर्णय चरण में उच्च- और निम्न-परिशुद्धता वाले LLMs के बीच अनुकूल रूप से चयन करने के लिए एक ढांचा है, ताकि लंबी अवधि के बहु-चरणीय कार्यों में इष्टतम सटीकता-लागत संतुलन प्राप्त किया जा सके।

Yuanzhe Li, Jianing Deng, Jingtong Hu, Tianlong Chen, Song Wang, Huanrui Yang2026-05-15
🤖 machine learning

Conformal Thinking: Risk Control for Reasoning on a Compute Budget

यह शोध पत्र तर्क करने वाले (reasoning) LLMs के लिए एक वितरण-मुक्त (distribution-free) जोखिम नियंत्रण ढांचे का प्रस्ताव करता है जो उपयोगकर्ता द्वारा निर्दिष्ट त्रुटि दर का कड़ाई से पालन करते हुए कंप्यूट लागत को कम करने के लिए नवीन ऊपरी और निचली सीमाओं का उपयोग करके अनुकूलित एडेप्टिव टोकन बजट निर्धारित करता है।

Xi Wang, Anushri Suresh, Alvin Zhang, Rishi More, William Jurayj, Benjamin Van Durme, Mehrdad Farajtabar, Daniel Khashab (…)2026-05-15
🤖 AI

Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning

यह शोध पत्र प्रॉक्सिमल एक्शन रिप्लेसमेंट (PAR) को प्रस्तुत करता है, जो एक प्लग-एंड-प्ले ट्रेनिंग सैंपल रिप्लेसर है जो वैल्यू फंक्शन एसेंट द्वारा निर्देशित बेहतर क्रियाओं के साथ उप-इष्टतम डेटासेट क्रियाओं को प्रतिस्थापित करके ऑफलाइन रीइन्फोर्समेंट लर्निंग में बिहेवियर क्लोनिंग-रेगुलराइज्ड एक्टर-क्रिटिक विधियों की प्रदर्शन सीमा को पार करता है, जिससे बेंचमार्क पर लगातार प्रदर्शन में सुधार होता है।

Jinzong Dong, Wei Huang, Jianshu Zhang, Zhuo Chen, Xinzhe Yuan, Qinying Gu, Zhaohui Jiang, Nanyang Ye2026-05-15
🤖 AI

Finding Interpretable Prompt-Specific Circuits in Language Models

यह शोध पत्र ACC++ प्रस्तुत करता है, जो एक उन्नत सर्किट-ट्रेसिंग विधि है जो एकल फॉरवर्ड पास से व्याख्या योग्य, प्रॉम्प्ट-विशिष्ट अटेंशन सर्किट निकालता है, जिससे यह पता चलता है कि भाषा मॉडल विभिन्न भाषाई संदर्भों में अप्रत्यक्ष ऑब्जेक्ट पहचान जैसे कार्यों को हल करने के लिए विशिष्ट, भाषा-निर्भर संकेतों का उपयोग कैसे करते हैं।

Gabriel Franco, Lucas M. Tassis, Azalea Rohr, Mark Crovella2026-05-15
🤖 AI

Numerical exploration of the range of shape functionals using neural networks

यह शोध पत्र एक नवीन संख्यात्मक ढांचे (numerical framework) को प्रस्तुत करता है जो दो और तीन आयामों में विभिन्न ज्यामितीय और PDE-आधारित आकार कार्यात्मकों (shape functionals) के लिए ब्लाशके-सेंटालो आरेख (Blaschke–Santaló diagrams) को कुशलतापूर्वक खोजने और समान रूप से नमूना लेने के लिए उत्क्रमणीय तंत्रिका नेटवर्क पैरामीट्रिकरण (invertible neural network parametrization) को एक परस्पर क्रिया करने वाली कण प्रणाली (interacting particle system) के साथ जोड़ता है।

Eloi Martinet, Ilias Ftouhi2026-05-15
🤖 AI

Hunt Globally: Wide Search AI Agents for Drug Asset Scouting in Investing, Business Development, and Competitive Intelligence

बहुभाषी, क्षेत्रीय स्रोतों में छिपी गैर-अमेरिकी दवा संपत्तियों की पहचान करने में मौजूद महत्वपूर्ण अंतर को दूर करने के लिए, यह शोध पत्र एक विशेष "बायोप्टिक एजेंट" (Bioptic Agent) और एक कठोर बेंचमार्किंग पद्धति का प्रस्ताव करता है जो फार्मास्युटिकल निवेश और बिजनेस डेवलपमेंट क्षेत्रों में अग्रणी डीप रिसर्च एआई मॉडलों की तुलना में बेहतर रिकॉल और सटीकता प्राप्त करता है।

Vlad Vinogradov, Alisa Vinogradova, Luba Greenwood, Ilya Yasny, Dmitry Kobyzev, Shoman Kasbekar, Kong Nguyen, Dmitrii Ra (…)2026-05-15
🤖 AI

Grokking Finite-Dimensional Algebra

यह शोध पत्र समूह ऑपरेशंस (group operations) से सामान्य परिमित-आयामी बीजगणित (finite-dimensional algebras) तक ग्रौकिंग (grokking) घटना के अध्ययन का विस्तार करता है, जो यह प्रदर्शित करता है कि कैसे बीजगणितीय गुण और संरचनात्मक टेंसर विशेषताएँ न्यूरल नेटवर्क में स्मृति (memorization) से सामान्यीकरण (generalization) के संक्रमण को प्रभावित करती हैं।

Pascal Jr Tikeng Notsawo, Guillaume Dumas, Guillaume Rabusseau2026-05-15
🤖 AI

CausalReasoningBenchmark: A Real-World Benchmark for Disentangled Evaluation of Causal Identification and Estimation

यह शोध पत्र CausalReasoningBenchmark प्रस्तुत करता है, जो 173 प्रश्नों का एक वास्तविक दुनिया का डेटासेट है जिसे कारण संबंधी अनुमान (causal inference) के पहचान और अनुमान चरणों को अलग-अलग मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि वर्तमान बड़े भाषा मॉडल संख्यात्मक गणना की तुलना में अनुसंधान डिजाइन के सूक्ष्म विवरणों के साथ अधिक संघर्ष करते हैं।

Ayush Sawarni, Jiyuan Tan, Vasilis Syrgkanis2026-05-15
🤖 machine learning

Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons

यह शोध पत्र रोबोटमीटर (Robometer) को प्रस्तुत करता है, जो एक स्केलेबल रिवॉर्ड मॉडलिंग फ्रेमवर्क है जो विविध विशेषज्ञ और उप-इष्टतम प्रक्षेप पथों (trajectories) से प्रभावी ढंग से सामान्यीकरण योग्य रिवॉर्ड फंक्शन सीखने के लिए बड़े पैमाने के RBM-1M डेटासेट पर प्रशिक्षित, फ्रेम-स्तरीय प्रगति पर्यवेक्षण (frame-level progress supervision) को प्रक्षेप पथ-तुलना प्राथमिकता शिक्षण (trajectory-comparison preference learning) के साथ जोड़ता है।

Anthony Liang, Yigit Korkmaz, Jiahui Zhang, Minyoung Hwang, Abrar Anwar, Sidhant Kaushik, Aditya Shah, Alex S. Huang, Lu (…)2026-05-15