Self-CTRL: Self-Consistency Training with Reinforcement Learning
यह शोध पत्र Self-CTRL को प्रस्तुत करता है, जो एक सुदृढीकरण शिक्षण (reinforcement learning) विधि है जो भाषा मॉडलों के स्व-स्पष्टीकरणों को उनके वास्तविक व्यवहार के साथ संरेखित करती है, जिससे संभाव्य तर्क (probabilistic reasoning) और संवैधानिक एआई (constitutional AI) कार्यों में पारदर्शिता, ऑडिटेबिलिटी और सुरक्षा में महत्वपूर्ण सुधार होता है।