NC-Bench: An LLM Benchmark for Evaluating Conversational Competence
NC-Bench एक सिद्धांत-आधारित बेंचमार्क पेश करता है जो बुनियादी, रिट्रीवल-ऑगमेंटेड और जटिल मल्टी-टर्न परिदृश्यों में प्राकृतिक अंतःक्रियाओं के रूप और संरचना को प्रबंधित करने की उनकी क्षमता का आकलन करके बड़े भाषा मॉडलों की संवादात्मक सक्षमता का मूल्यांकन करता है, जिससे यह पता चलता है कि जहाँ मॉडल बुनियादी उत्तर देने में उत्कृष्ट हैं, वहीं वे मरम्मत (रिपेयर) और जटिल अनुक्रम प्रबंधन कार्यों के साथ महत्वपूर्ण रूप से संघर्ष करते हैं।