Pairwise matrices for sparse autoencoders: single-feature inspection mislabels causal axes
تقدم هذه الورقة بروتوكول مصفوفة زوجي لقابلية تفسير المشفّر التلقائي المتناثر، يكشف كيف يؤدي فحص الميزة المنفردة إلى تصنيف المحاور السببية بشكل خاطئ، مما يثبت أن التلاعب المشترك بالميزات يكشف عن تأثيرات معقدة وغير خطية ونُظم فقدان تماسك متميزة غير مرئية لطرق توجيه الميزة المنفردة القياسية.