Wisdom is Knowing What not to Say: Hallucination-Free LLMs Unlearning via Attention Shifting
यह शोध पत्र अटेंशन-शिफ्टिंग (AS) फ्रेमवर्क प्रस्तुत करता है, जो एक नवीन मशीन अनलर्निंग दृष्टिकोण है जो संदर्भ-संरक्षण दमन (context-preserving suppression) और मतिभ्रम-प्रतिरोधी प्रतिक्रिया आकार (hallucination-resistant response shaping) को नियोजित करके उपयोगिता संरक्षण और मतिभ्रम रोकथाम के बीच संतुलन बनाता है, ताकि बड़े भाषा मॉडलों के सामान्य प्रदर्शन से समझौता किए बिना संवेदनशील ज्ञान को चुनिंदा रूप से हटाया जा सके।