Tuning Derivatives for Causal Fairness in Machine Learning
本文提出了一种针对连续受保护属性的新颖因果公平框架,该框架通过路径特定的偏导数形式化统计公平性与预测公平性,从而能够构建在消除歧视性路径影响与保留合法业务因素之间取得平衡的公平预测器。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,你正在聘请一位厨师为一大群人准备餐食。你希望食物美味可口(准确),但同时也必须确保厨师不会基于种族、性别或年龄,暗中偏袒某一群食客。这就是人工智能中公平性的核心问题。
本文解决的是该问题的一个具体且棘手的版本:我们如何阻止人工智能对特定人群产生偏见,同时仍允许其使用那些恰好与这些人群相关联的重要信息?
以下是他们解决方案的分解说明,采用简单的类比。
问题:“业务必要性”困境
想象一位法官使用人工智能来决定罪犯是否可能再次犯罪。
- 受保护属性:罪犯的种族和年龄。法律规定人工智能不得将这些因素用于决策。
- 业务必要性:过往犯罪次数。法官需要了解这一点才能做出公正的预测。
这里的难点在于:在现实世界中,一个人的种族或年龄往往会影响其被记录的过往犯罪次数(这是由于执法中的历史偏见所致)。
- 如果人工智能为了免受“种族”偏见影响而忽略“过往犯罪次数”,它就会变成一个糟糕的法官(因为它遗漏了重要事实)。
- 如果人工智能使用“过往犯罪次数”,它可能会无意中从“种族”中“学习”到偏见,从而再次变得不公平。
旧方法与新方法
旧方法(统计公平性):
这就像告诉厨师:“无论面对谁,你必须为每个人提供完全相同的菜肴。”如果厨师试图这样做,他们可能不得不忽略某些人对坚果过敏的事实(这是出于安全的“业务必要性”)。其结果是,这顿饭在严格意义上是“公平”的,但却无用甚至危险。
新方法(因果公平性):
本文提出了一种更聪明的方法。它指出:“人工智能可以查看‘过往犯罪次数’(允许的路径),但必须忽略从‘种族’到最终决策的直接联系(禁止的路径)。”
然而,大多数以往实现这一目标的方法仅在受保护属性是简单类别(如“男性”或“女性”)时效果良好。它们难以处理连续属性,例如年龄(你可以是 20 岁、20.1 岁、20.2 岁等)。
解决方案:利用导数“调节旋钮”
作者引入了一种新的数学工具,称为导数。
将人工智能模型想象成一台拥有许多旋钮和杠杆的复杂机器。
- 统计公平性(SPD):作者希望将“禁止路径”(种族 → 决策)的“旋钮”调至这样一个位置:转动它不会对输出产生任何影响。用数学术语来说,就是“导数”(变化率)为零。如果你稍微改变种族,预测结果不应有任何变动。
- 预测公平性(PPD):同时,他们希望确保“允许路径”(过往犯罪次数 → 决策)的“旋钮”被调节得恰到好处。人工智能对“过往犯罪次数”的反应应与现实世界完全一致。
走钢丝的类比:
想象你在走钢丝。
- 一边是公平性(忽略偏见)。
- 另一边是准确性(使用必要数据)。
- 有时,钢丝是直的,你可以同时完美地走在两边。
- 有时,钢丝是扭曲的。你无法同时做到绝对公平和绝对准确。
本文证明,有时数学允许你同时实现完美的公平和准确。但通常情况下,你必须做出权衡。
“公平调节”算法
作者构建了一个食谱(算法),帮助人工智能开发者找到那条钢丝上的最佳位置。
- 第一步:首先,训练人工智能尽可能准确,暂时忽略公平性。
- 第二步:然后,“调节”人工智能。该算法检查“旋钮”(导数)。
- 如果人工智能对禁止属性(种族)的反应仍然过强,算法就会将该旋钮调低。
- 如果人工智能对必要属性(过往犯罪次数)的反应过于微弱,算法就会将该旋钮调高,以匹配现实情况。
- 结果:人工智能学会做出尽可能公平的预测,同时不牺牲其准确性。
他们的发现
他们在两方面测试了这种方法:
- 模拟数据:他们创建了具有不同规则的虚拟世界。
- 在“线性”世界(事物简单)中,他们发现你可以同时实现完美的公平和准确。
- 在“乘性”世界(事物复杂且扭曲)中,他们发现你无法在两方面都做到完美。你必须选择一个平衡点。他们的方法使他们能够找到最佳可能的平衡。
- 真实数据(COMPAS):他们使用了一个关于罪犯累犯的真实数据集。
- 他们表明,他们的方法(称为“公平调节”)创建了一个模型,在平衡公平性与准确性方面比旧方法要好得多。
- 具体来说,它在保留“允许”信息(如过往犯罪次数)的有用性的同时,消除“禁止”偏见方面表现更佳。
核心结论
本文为我们提供了一种新的数学“调节旋钮”用于人工智能。它使我们能够比以往更好地处理连续变量(如年龄)。它承认,有时我们无法拥有一个偏见为零且准确率为 100% 的完美世界,但它提供了一种精确的方法,让我们找到最佳可能的妥协方案,确保人工智能在遵守法律(公平性)的同时,仍能做好其本职工作(准确性)。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。