💻 computer science

PySynthea: A Python-Native Framework for Scalable Synthetic Healthcare Data Generation

यह शोध पत्र PySynthea को प्रस्तुत करता है, जो एक पायथन-नेटिव (Python-native) फ्रेमवर्क है जो व्यापक रूप से उपयोग किए जाने वाले Synthea सिस्टम की पुनर्कल्पना करता है ताकि परिनियोजन बाधाओं को दूर किया जा सके और आधुनिक वैज्ञानिक पायथन वर्कफ़्लो में सिंथेटिक स्वास्थ्य सेवा डेटा जनरेशन को निर्बाध रूप से एकीकृत किया जा सके, जिससे पहुंच में वृद्धि हो सके और अनुसंधान एवं एआई (AI) विकास को गति मिल सके।

Roberto Cruz, David Rey-Blanco2026-06-30
💻 computer science

SWE-MeM: Learning Adaptive Memory Management for Long-Horizon Coding Agents

SWE-MeM एक प्रशिक्षण ढांचा है जो सॉफ्टवेयर इंजीनियरिंग एजेंटों को एक लचीले टूल और मेमोरी-अवेयर GRPO के माध्यम से अनुकूलन योग्य, ऑन-डिमांड मेमोरी प्रबंधन क्षमताओं के साथ सुसज्जित करता है, जिससे वे संदर्भ उपयोग को गतिशील रूप से अनुकूलित कर सकते हैं और मौजूदा स्थिर विधियों की तुलना में लंबी अवधि के कोडिंग कार्यों पर बेहतर प्रदर्शन प्राप्त कर सकते हैं।

Shuzheng Gao, Wenhao Zeng, Zhaojian Yu, Jianqiao Wangni, Chaozheng Wang, Kai Cai, Shilin He, Michael R. Lyu2026-06-30
💻 computer science

When AI Reviews Its Own Code: Recursive Self-Training Collapse in Code LLMs

यह शोधपत्र यह प्रदर्शित करता है कि कोड एलएलएम (LLMs) में पुनरावर्ती स्व-प्रशिक्षण (recursive self-training), एआई-जनित डेटा पर निर्भर होने के कारण अनिवार्य रूप से प्रदर्शन पतन (performance collapse) की ओर ले जाता है, जो यह सिद्ध करता है कि क्षरण के आत्म-सुदृढ़ीकरण चक्र को तोड़ने के लिए बाह्य मानव सत्यापन के बिना स्वचालित समीक्षा तंत्र भी विफल हो जाते हैं।

Xinyuan Song, Zekun Cai, Liang Zhao2026-06-30
💻 computer science

Evaluating LLMs on Java Code Snippet Adaptation Using a Mutation-Injection Framework

यह शोध पत्र निर्देश-मुक्त जावा कोड स्निपेट अनुकूलन (instruction-free Java code snippet adaptation) पर लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करने के लिए एक म्यूटेशन-इंजेक्शन फ्रेमवर्क प्रस्तावित करता है, जो एक उच्च टेस्ट कवरेज वाले ओपन-सोर्स रिपॉजिटरी से प्राप्त डेटासेट का उपयोग करते हुए विभिन्न अनुकूलन प्रकारों, जटिलता स्तरों और संदर्भ सूक्ष्मता (context granularities) के माध्यम से प्रदर्शन में होने वाले बदलावों की जांच करता है।

Ali Aman, Muhammad Asaduzzaman, Shaowei Wang, Chanchal K. Roy2026-06-30
💻 computer science

From Determinism to Delegation: AI-Native Software Engineering and the Evolution of the Agentic Engineer

यह शोधपत्र तर्क देता है कि एआई-नेटिव सॉफ्टवेयर इंजीनियरिंग (AI-Native Software Engineering) नियतत्ववादी कोडिंग (deterministic coding) से संभाव्य स्वायत्त एजेंटों (probabilistic autonomous agents) की निगरानी करने की ओर एक मौलिक प्रतिमान परिवर्तन (paradigm shift) का प्रतिनिधित्व करती है, जो इंजीनियर की भूमिका को एक "एजेंटिक इंजीनियर" (Agentic Engineer) के रूप में पुनर्परिभाषित करती है जो पारंपरिक कोड लेखकता के बजाय परिणाम स्वामित्व (outcome ownership) और अनुशासित निरीक्षण को प्राथमिकता देता है।

Mamdouh Alenezi2026-06-30
💻 computer science

Reward-Free Code Alignment from Pretrained or Fine-Tuned LLM: Unpacking the Trade-offs for Code Generation

यह अनुभवजन्य अध्ययन कोड जनरेशन के लिए प्रीट्रेन्ड (pretrained) और इंस्ट्रक्शन-ट्यून्ड (instruction-tuned) दोनों प्रकार के एलएलएम (LLMs) पर रिवॉर्ड-फ्री अलाइनमेंट तकनीकों (DPO और BoNBoN) को लागू करने के ट्रेड-ऑफ की जांच करता है, जो यह प्रकट करता है कि जबकि प्रीट्रेन्ड मॉडल्स को अलाइन करने से बड़े सापेक्ष सुधार प्राप्त होते हैं, इंस्ट्रक्शन-ट्यून्ड मॉडल्स से शुरुआत करने पर आम तौर पर उच्च पूर्ण सटीकता बनी रहती है, भले ही वे कम लाभ या संभावित गिरावट प्रदान करते हों।

Gias Uddin, Sanjeepan Sivapiran2026-06-30
💻 computer science

Agent Security Meets Regulatory Reality -- A Practitioner Systematization of Autonomous-Agent Threats and Controls in Regulated Financial Systems

विनियमित वित्तीय प्रणालियों में उत्पादन अनुभव का उपयोग करते हुए, यह शोध पत्र एजेंटिक खतरों को विशिष्ट अमेरिकी और यूरोपीय संघ के कानूनी दायित्वों के साथ मानचित्रित करके, स्वचालित केवाईसी प्रक्रियाओं के लिए चार सफल वास्तुशिल्प पैटर्न का विवरण देकर, और उन महत्वपूर्ण नियंत्रण विफलताओं को उजागर करके जो वास्तविक दुनिया के परिनियोजन में कठोर ऑडिटेबिलिटी और न्यूनतम-विशेषाधिकार प्रवर्तन की आवश्यकता को रेखांकित करती हैं, एजेंट सुरक्षा और नियामक अनुपालन के बीच के अंतर को पाटता है।

Krishna Mohan, Guda Nagavenkata Srinivasa2026-06-30
💻 computer science

SAKE: Software Architectural Knowledge Evaluation Benchmark for Large Language Models

यह शोधपत्र SAKE को प्रस्तुत करता है, जो 2,154 विशेषज्ञ-क्यूरेटेड प्रश्नों से युक्त एक मानकीकृत बेंचमार्क है, जिसे विभिन्न श्रेणियों और संदर्भ लंबाई (context lengths) में लार्ज लैंग्वेज मॉडल्स की सॉफ्टवेयर आर्किटेक्चरल रीजनिंग क्षमताओं में दक्षता अंतराल का मूल्यांकन करने और उन्हें प्रकट करने के लिए डिज़ाइन किया गया है।

Tiziano Santilli, Francesco Daghero, Mayhar Tourchi Moghaddam2026-06-30
💻 computer science

RESOURCE2SKILL: Distilling Executable Agent Skills from Human-Created Multimodal Resources

RESOURCE2SKILL एक ऐसा फ्रेमवर्क है जो ट्यूटोरियल वीडियो और कोड रिपॉजिटरी जैसे विविध मल्टीमॉडल मानव संसाधनों को एक पदानुक्रमित, निष्पादन योग्य 'स्किल विकी' (Skill Wiki) में संकुचित करता है, जिससे सॉफ्टवेयर एजेंट विभिन्न लेखन डोमेन में इन कौशलों को पुनः प्राप्त करने और उन्हें संयोजित करने के माध्यम से अपने प्रदर्शन में महत्वपूर्ण सुधार कर सकते हैं।

Yijia Fan, Zonglin Di, Zimo Wen, Yifan Yang, Mingxi Cheng, Qi Dai, Bei Liu, Kai Qiu, Yue Dong, Ji Li, Chong Luo2026-06-30
💻 computer science

Deforking the World of Code: A Project-Provenance Map that Recovers Cross-Forge Fork Families that Platform Graphs Cannot See

यह शोध पत्र 'वर्ल्ड ऑफ कोड' के लिए एक क्यूरेटेड "डीफ़ोर्किंग" (deforking) मानचित्र प्रस्तुत करता है जो साझा गिट इतिहासों को एकीकृत क्लस्टरों में समाहित करके क्रॉस-फोर्ज प्रोजेक्ट परिवारों का पुनर्निर्माण करता है, जिससे लोकप्रियता के मुद्रास्फीति को सुधारा जाता है और हजारों फोर्क संबंधों—जिनमें मल्टी-फोर्ज परिवार और गैर-गिटहब मूल शामिल हैं—को प्रकट किया जाता है जो प्लेटफॉर्म-विशिष्ट ग्राफों के लिए अदृश्य हैं।

Audris Mockus2026-06-30