Alignment Whack-a-Mole : Finetuning Activates Verbatim Recall of Copyrighted Books in Large Language Models
यह शोधपत्र यह प्रदर्शित करता है कि विशिष्ट लेखकों की कृतियों पर लार्ज लैंग्वेज मॉडल्स को फाइनट्यून करना मौजूदा सुरक्षा संरेखण (सेफ्टी अलाइनमेंट) उपायों को दरकिनार कर कॉपीराइट वाली पुस्तकों के शब्दशः पुनरुद्धार (वर्बेटिकल रिकॉल) को ट्रिगर कर सकता है, जो यह प्रकट करता है कि मॉडल वेट्स स्वाभाविक रूप से प्रशिक्षण डेटा की प्रतियां संग्रहीत करते हैं और इस कानूनी आधार को चुनौती देता है कि वर्तमान सुरक्षा उपाय कॉपीराइट उल्लंघन को रोकने के लिए पर्याप्त हैं।