Fairness Shields: Safeguarding against Biased Decision Makers
Filip Cano, Thomas A. Henzinger, Bettina Könighofer, Konstantin Kueffner, Kaushik Mallik
摘要
As AI-based decision-makers increasingly influence human lives, it is a growing concern that their decisions are often unfair or biased with respect to people's sensitive attributes, such as gender and race. Most existing bias prevention measures provide probabilistic fairness guarantees in the long run, and it is possible that the decisions are biased on specific instances of short decision sequences. We introduce fairness shielding, where a symbolic decision-maker-the fairness shield-continuously monitors the sequence of decisions of another deployed black-box decision-maker, and makes interventions so that a given fairness criterion is met while the total intervention costs are minimized. We present four different algorithms for computing fairness shields, among which one guarantees fairness over fixed horizons, and three guarantee fairness periodically after fixed intervals. Given a distribution over future decisions and their intervention costs, our algorithms solve different instances of bounded-horizon optimal control problems with different levels of computational costs and optimality guarantees. Our empirical evaluation demonstrates the effectiveness of these shields in ensuring fairness while maintaining cost efficiency across various scenarios.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了最后一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper1
问问它们各自怎么用它它引用的顶会 Paper7
- FFB: A Fair Fairness Benchmark for In-Processing Group Fairness MethodsXiaotian Han, Jianfeng Chi, Yu Chen, Qifan Wang 等ICLR 2024 · 被引用 48 次
- Justicia: A Stochastic SAT Approach to Formally Verify FairnessBishwamittra Ghosh, Debabrota Basu, Kuldeep S. MeelAAAI 2021 · 被引用 46 次
- Certifying Robustness to Programmable Data Bias in Decision TreesAnna P. Meyer, Aws Albarghouthi, Loris D'AntoniNeurIPS 2021 · 被引用 34 次
- Achieving Long-Term Fairness in Sequential Decision MakingYaowei Hu, Lu ZhangAAAI 2022 · 被引用 29 次
- Probabilistic Verification of Neural Networks Against Group FairnessBing Sun, Jun Sun, Ting Dai, Lijun ZhangFM 2021 · 被引用 20 次
相关 Paper
- Causal Fairness for Outcome ControlDrago Plecko, Elias BareinboimNeurIPS 2023 · 被引用 17 次
- On Testing for Discrimination Using Causal ModelsHana Chockler, Joseph Y. HalpernAAAI 2022 · 被引用 5 次
- Monitoring Algorithmic FairnessThomas A. Henzinger, Mahyar Karimi, Konstantin Kueffner, Kaushik MallikCAV 2023 · 被引用 13 次
- Fairness-aware Adversarial Perturbation Towards Bias Mitigation for Deployed Deep ModelsZhibo Wang, Xiaowei Dong, Henry Xue, Zhifei Zhang 等CVPR 2022 · 被引用 49 次
- Online Fairness Auditing through Iterative RefinementPranav Maneriker, Codi Burley, Srinivasan ParthasarathyKDD 2023 · 被引用 6 次
