Thought-Transfer: Indirect Targeted Poisoning Attacks on Chain-of-Thought Reasoning Models
यह शोध पत्र "थॉट-ट्रांसफर" (Thought-Transfer) को पेश करता है, जो एक नवीन अप्रत्यक्ष लक्षित पॉइजनिंग हमला है जो पूरी तरह से अलग डोमेन से दोषपूर्ण चेन-ऑफ-थॉट (Chain-of-Thought) ट्रेसों को प्रशिक्षण डेटा में इंजेक्ट करके एक विशिष्ट लक्षित कार्य पर भाषा मॉडल के तर्क को मैनिपुलेट करता है, जो क्वेरी या उत्तरों को बदले बिना उच्च सफलता दर प्राप्त करता है और साथ ही मॉडल के समग्र बेंचमार्क प्रदर्शन में सुधार करता है।