Imaging-101: Benchmarking LLM Coding Agents on Scientific Computational Imaging
यह शोध पत्र इमेजिंग-101 (Imaging-101) प्रस्तुत करता है, जो छह वैज्ञानिक डोमेन में 57 विशेषज्ञ-सत्यापित कम्प्यूटेशनल इमेजिंग कार्यों का एक बेंचमार्क है जिसे LLM कोडिंग एजेंटों का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि वर्तमान फ्रंटियर मॉडल एल्गोरिदम चयन और भौतिक परंपराओं (physical convention) के प्रबंधन जैसे डोमेन-विशिष्ट चुनौतियों के साथ संघर्ष करते हैं, जिससे विश्वसनीय वैज्ञानिक खोज को सक्षम करने के लिए विशिष्ट, कौशल-संवर्धित एजेंटों की आवश्यकता पर बल मिलता है।