OpenCompass: A Universal Evaluation Platform for Large Language Models
यह शोध पत्र OpenCompass को प्रस्तुत करता है, जो एक ओपन-सोर्स, स्केलेबल और उच्च-समानांतरता (high-concurrency) वाला मूल्यांकन मंच है, जिसे विविध डोमेन में बड़े भाषा मॉडलों के व्यापक और कुशल मूल्यांकन के लिए एक मॉड्यूलर, एकीकृत ढांचे के माध्यम से पारंपरिक स्थिर बेंचमार्क की सीमाओं को दूर करने के लिए डिज़ाइन किया गया है।