Enhancing LLMs through human feedback: a journey towards self-improvement
यह शोध पत्र एक नवीन ह्यूमन-इन-द-लूप कार्यप्रणाली प्रस्तावित करता है जो निरंतर उपयोगकर्ता फीडबैक के माध्यम से एक प्राथमिक RAG सिस्टम के प्रदर्शन को पुनरावृत्ति से परिष्कृत करने के लिए एक सहायक फीडबैक RAG सिस्टम को एकीकृत करता है, जो LLM-एज़-अ-जज मूल्यांकन के माध्यम से विविध बेंचमार्क में सटीकता और प्रासंगिकता में महत्वपूर्ण सुधार प्रदर्शित करता है।