ThaiSafetyBench: Assessing Language Model Safety in Thai Cultural Contexts
यह शोध पत्र ThaiSafetyBench प्रस्तुत करता है, जो 1,954 सांस्कृतिक रूप से सूक्ष्म थाई प्रॉम्प्ट्स का एक ओपन-सोर्स बेंचमार्क है जो वर्तमान LLMs—विशेष रूप से ओपन-सोर्स मॉडल और वे जो सांस्कृतिक रूप से विशिष्ट हमलों का सामना कर रहे हैं—में महत्वपूर्ण सुरक्षा अंतराल को प्रकट करता है, साथ ही थाई संदर्भ में सुरक्षा मूल्यांकन को आगे बढ़ाने के लिए एक उच्च-प्रदर्शन क्लासिफायर और लीडरबोर्ड भी प्रदान करता है।