🤖 AI

OpenComputer: Verifiable Software Worlds for Computer-Use Agents

यह शोधपत्र OpenComputer प्रस्तुत करता है, जो एक सत्यापनकर्ता-आधारित (verifier-grounded) ढांचा है जो कंप्यूटर-उपयोग करने वाले एजेंटों के लिए सत्यापन योग्य सॉफ्टवेयर जगत का निर्माण करता है, जिसमें एप्लिकेशन-विशिष्ट अवस्था सत्यापनकर्ताओं (application-specific state verifiers), एक स्व-विकसित होने वाले सत्यापन परत (self-evolving verification layer), एक कार्य-जनरेशन पाइपलाइन और एक मूल्यांकन हारनेस को एकीकृत किया गया है ताकि वर्तमान सीमावर्ती (frontier) और ओपन-सोर्स एजेंटों की आंशिक प्रगति के बावजूद उनकी मजबूती में महत्वपूर्ण अंतराल को उजागर किया जा सके।

Jinbiao Wei, Qianran Ma, Yilun Zhao, Xiao Zhou, Kangqi Ni, Guo Gan, Arman Cohan2026-05-20
🤖 AI

Prior Knowledge or Search? A Study of LLM Agents in Hardware-Aware Code Optimization

यह अध्ययन प्रदर्शित करता है कि हार्डवेयर-जागरूक कोड अनुकूलन (hardware-aware code optimization) में एलएलएम (LLM) एजेंट मुख्य रूप से प्रीट्रेंड प्रायर्स (pretrained priors) पर निर्भर करते हैं न कि पुनरावृत्ति फीडबैक (iterative feedback) या एजेंटिक संरचनाओं पर, जैसा कि ब्लैक-बॉक्स सेटिंग्स में उनके ग्रीडी व्यवहार (greedy behavior), अनदेखे कर्नेल आकारों के प्रति अनुकूलन करने में अक्षमता, और लो-डेंसिटी इंटरमीडिएट रिप्रेजेंटेशन (low-density intermediate representations) के साथ काम करने पर प्रदर्शन में गिरावट से सिद्ध होता है।

Dmitry Redko (Applied AI Institute), Albert Fazlyev (AI Talent Hub, ITMO University), Konstantin Sozykin (Applied AI Ins (…)2026-05-20
💻 computer science

Can LLMs Produce Better Object-Oriented Designs than Human-Involved Development?

यह अध्ययन प्री-एलएलएम (pre-LLM), पोस्ट-एलएलएम (post-LLM) और प्योर-एलएलएम (pure-LLM) जावा परियोजनाओं में ऑब्जेक्ट-ओरिएंटेड डिज़ाइन गुणवत्ता की तुलना करता है, जिसमें यह पाया गया है कि हालांकि एलएलएम-जनित कोड कम जटिलता और कम कोड स्मेल्स (code smells) प्रदर्शित करता है, लेकिन यह अक्सर अति-सरलीकरण और कमजोर उत्तरदायित्व पृथक्करण से ग्रस्त होता है, जो डिज़ाइन अपघटन (design decomposition) में मानवीय मार्गदर्शन की निरंतर आवश्यकता को रेखांकित करता है।

Zushuai Zhang, Elliott Wen, Ewan Tempero2026-05-20
💻 computer science

OpenHealth Lake: Designing and testing a data lakehouse platform for health applications

यह शोध पत्र ओपनहेल्थ लेक (OpenHealth Lake) के डिज़ाइन, कार्यान्वयन और उपयोगकर्ता सत्यापन को प्रस्तुत करता है, जो एक ओपन-सोर्स, FAIR-अनुपालन डेटा लेकहाउस प्लेटफॉर्म है जो वैश्विक सहयोगात्मक अनुसंधान के लिए एक लचीला, स्केलेबल और सुरक्षित समाधान प्रदान करके जटिल स्वास्थ्य डेटा प्रबंधन चुनौतियों का समाधान करता है।

Danilo Silva, Monika Moir, Cheryl Baxter, Tulio de Oliveira, Joicymara Xavier, Marcel Dunaiski2026-05-20
🤖 AI

A Case for Agentic Tuning: From Documentation to Action in PostgreSQL

यह शोध पत्र PerfEvolve को पेश करता है, जो एक ऐसा सिस्टम है जो डेटाबेस ट्यूनिंग को स्थिर दस्तावेज़ीकरण से गतिशील, LLM-संचालित कार्यों में स्थानांतरित करता है, विशेषज्ञ कार्यप्रणालियों को निष्पादन योग्य कौशल में अनुवादित करके, जो PostgreSQL पर अत्याधुनिक बेसलाइन की तुलना में 35.2% तक प्रदर्शन सुधार प्राप्त करता है।

Hongyu Lin, Mingyu Li, Weichen Zhang, Yihang Lou, Mingjie Xing, Yanjun Wu, Haibo Chen2026-05-20
🤖 AI

Towards LLM-Assisted Architecture Recovery for Real-World ROS~2 Systems: An Agent-Based Multi-Level Approach to Hierarchical Structural Architecture Reconstruction

यह शोध पत्र मौजूदा नोड-स्तरीय विधियों की सीमाओं को दूर करने के लिए परिष्कृत LLM प्रॉम्प्टिंग और एक चरणबद्ध रिकवरी रणनीति का उपयोग करके, जटिल वास्तविक दुनिया के ROS 2 सिस्टम में पदानुक्रमित सॉफ्टवेयर आर्किटेक्चर को पुनर्प्राप्त करने के लिए एक उन्नत एजेंट-आधारित, बहु-स्तरीय दृष्टिकोण प्रस्तुत करता है।

Dominique Briechle, Raj Chanchad, Tobias Geger, Ruidi He, Dhruv Jajadiya, Dhruv Kapadiya, Andreas Rausch, Meng Zhang2026-05-20
💬 NLP

Automated Knowledge Component Generation for Interpretable Knowledge Tracing in Coding Problems

यह शोध पत्र KCGen-KT को प्रस्तुत करता है, जो एक स्वचालित LLM-आधारित पाइपलाइन है जो ओपन-एंडेड कोडिंग समस्याओं के लिए नॉलेज कंपोनेंट्स (ज्ञान घटकों) को उत्पन्न और टैग करती है, और व्यापक मूल्यांकन के माध्यम से यह प्रदर्शित करती है कि ये AI-जनरेटेड घटक छात्र प्रदर्शन की भविष्यवाणी करने और लर्निंग कर्व्स को मॉडल करने में पारंपरिक मानव-लिखित घटकों से बेहतर प्रदर्शन करते हैं।

Zhangqi Duan, Nigel Fernandez, Arun Balajiee Lekshmi Narayanan, Mohammad Hassany, Rafaella Sampaio de Alencar, Peter Bru (…)2026-05-19
💻 computer science

An empirical analysis of vulnerability detection tools for solidity smart contracts

यह शोध पत्र हाल ही में जारी किए गए, 2,182 सॉलिडिटी स्मार्ट कॉन्ट्रैक्ट्स के मैन्युअल रूप से एनोटेटेड डेटासेट पर 20 स्वचालित भेद्यता (वल्नरेबिलिटी) डिटेक्शन टूल्स और एक एलएलएम-आधारित विधि का अनुभवजन्य मूल्यांकन करता है, जो टूल की सटीकता में महत्वपूर्ण भिन्नताओं को प्रकट करता है और यह प्रदर्शित करता है कि तीन विशिष्ट टूल्स के एक सेट को संयोजित करने से एक मिनट से भी कम समय में 76.78% तक भेद्यताओं का पता लगाया जा सकता है।

Francesco Salzano, Cosmo Kevin Antenucci, Simone Scalabrino, Giovanni Rosa, Rocco Oliveto, Remo Pareschi2026-05-19
💻 computer science

Cost-Performance Analysis of Cloud-Based Retail Point-of-Sale Systems: A Comparative Study of Google Cloud Platform and Microsoft Azure

यह शोध पत्र गूगल क्लाउड प्लेटफॉर्म और माइक्रोसॉफ्ट एज़्योर पर रिटेल पॉइंट-ऑफ-सेल वर्कलोड का एक पारदर्शी, कोड-संचालित तुलनात्मक विश्लेषण प्रस्तुत करता है, जो यह प्रकट करता है कि GCP 23% तेज़ रिस्पॉन्स टाइम प्रदान करता है जबकि एज़्योर 71.9% अधिक लागत दक्षता प्रदान करता है, जिससे व्यापारियों के लिए क्लाउड-आधारित POS समाधानों का मूल्यांकन करने हेतु एक पुनरुत्पादक ढांचा स्थापित होता है।

Ravi Teja Pagidoju2026-05-19
🤖 machine learning

Automatic Generation of High-Performance RL Environments

यह शोध पत्र एक क्लोज्ड-लूप कार्यप्रणाली प्रस्तुत करता है जो जेनेरिक प्रॉम्प्ट्स, पदानुक्रमित सत्यापन (hierarchical verification) और पुनरावृत्ति सुधार (iterative repair) का उपयोग करके न्यूनतम कंप्यूट लागत के साथ उच्च-प्रदर्शन वाले सुदृढीकरण लर्निंग (reinforcement learning) वातावरण को स्वचालित रूप से उत्पन्न करता है ताकि प्रत्यक्ष अनुवाद, प्रदर्शन समानता सत्यापन और नवीन वातावरण निर्माण सहित विविध वर्कफ़्लो में समानता सुनिश्चित की जा सके।

Seth Karten, Rahul Dev Appapogu, Chi Jin2026-05-19