Where Do AI Coding Agents Fail? An Empirical Study of Failed Agentic Pull Requests in GitHub
यह शोध पत्र GitHub पर 33,000 AI-जनित पुल रिक्वेस्ट (pull requests) के एक बड़े पैमाने के अनुभवजन्य अध्ययन को प्रस्तुत करता है, जो मात्रात्मक विश्लेषण और गुणात्मक वर्गीकरण (qualitative taxonomy) को जोड़कर यह प्रकट करता है कि जहाँ दस्तावेज़ीकरण और CI कार्य सबसे अधिक बार सफल होते हैं, वहीं एजेंटिक विफलताएं बड़े कोड परिवर्तनों, CI विफलताओं और मानव समीक्षक की अपेक्षाओं के साथ मिसअलाइनमेंट जैसे कारकों द्वारा संचालित होती हैं।