Fair Finetuning Mitigates Distribution Inference Attacks
This paper introduces Fair Fine-tuning (FFt), a method that mitigates distribution inference attacks by fine-tuning models on complementary data under Equalized Odds constraints, theoretically proving that adversarial advantage is bounded by fairness disparity and empirically demonstrating significant reductions in attack success across diverse datasets.