PolicyLLM: Towards Excellent Comprehension of Public Policy for Large Language Models
यह शोध पत्र पॉलिसीबेंच (PolicyBench) को पेश करता है, जो स्मृति (memorization), समझ (understanding) और अनुप्रयोग (application) के माध्यम से नीति बोध (policy comprehension) के मूल्यांकन के लिए एक बड़े पैमाने का क्रॉस-सिस्टम बेंचमार्क है, और पॉलिसीमोई (PolicyMoE) का प्रस्ताव करता है, जो एक विशिष्ट मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल है जो संरचित तर्क (structured reasoning) और अनुप्रयोग-उन्मुख नीति कार्यों पर उत्कृष्ट प्रदर्शन प्रदर्शित करता है।