Undetectable Backdoors in Model Parameters: Hiding Sparse Secrets in High Dimensions
यह शोध पत्र "स्पार्स बैकडोर" (Sparse Backdoor) को प्रस्तुत करता है, जो एक आपूर्ति श्रृंखला हमला (supply chain attack) है जो पूर्व-प्रशिक्षित इमेज क्लासिफायर में गॉसियन डिदरिंग (Gaussian dithering) द्वारा छिपा हुआ एक प्रमाणित रूप से अप्राप्य स्पार्स परटर्बेशन (sparse perturbation) इंजेक्ट करता है, यह प्रदर्शित करते हुए कि समझौता किए गए मॉडल को स्वच्छ संदर्भ से अलग करना मानक हार्डनेस धारणाओं के तहत कम्प्यूटेशनल रूप से असंभव है।