Policy-Grounded Safety Evaluation of 20 Large Language Models
यह शोध पत्र अयारा एआई (Aymara AI) को प्रस्तुत करता है, जो नीति-आधारित सुरक्षा मूल्यांकनों को उत्पन्न करने के लिए एक प्रोग्रामेटिक प्लेटफॉर्म है, जिसका उपयोग 20 लार्ज लैंग्वेज मॉडल्स का आकलन करने के लिए किया गया था और इसने विभिन्न डोमेन में प्रदर्शन की महत्वपूर्ण असमानताओं को प्रकट किया, जो वर्तमान एलएलएम (LLM) सुरक्षा की असंगत और संदर्भ-निर्भर प्रकृति को उजागर करता है।