Mitigating the Safety-utility Trade-off in LLM Alignment via Adaptive Safe Context Learning
यह शोध पत्र एडेप्टिव सेफ कॉन्टेक्स्ट लर्निंग (ASCL) फ्रेमवर्क का प्रस्ताव करता है, जो सुरक्षा को एक मल्टी-टर्न टूल-यूज़ प्रक्रिया के रूप में स्वरूपित करके और तर्क क्षमताओं को संरक्षित करते हुए स्वायत्त नियम परामर्श को सक्षम करने के लिए इनवर्स फ्रीक्वेंसी पॉलिसी ऑप्टिमाइज़ेशन (IFPO) को पेश करके LLM अलाइनमेंट में सुरक्षा-उपयोगिता ट्रेड-ऑफ को कम करता है।