An Insight into Security Code Review with LLMs: Capabilities, Obstacles, and Influential Factors
यह अनुभवजन्य अध्ययन प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स, विशेष रूप से डीपसीक-आर1 (DeepSeek-R1) जैसे तर्क-अनुकूलित मॉडल्स, सुरक्षा कोड समीक्षा में अत्याधुनिक स्टैटिक एनालिसिस टूल्स की तुलना में काफी बेहतर प्रदर्शन करते हैं, जबकि यह भी पहचानते हैं कि प्रॉम्प्ट इंजीनियरिंग रणनीतियाँ, कोड जटिलता और फ़ाइल का आकार उनकी पहचान सटीकता और प्रतिक्रिया गुणवत्ता को प्रभावित करने वाले महत्वपूर्ण कारक हैं।