Certifying Robustness to Programmable Data Bias in Decision Trees
Anna P. Meyer, Aws Albarghouthi, Loris D'Antoni
Abstract
Datasets can be biased due to societal inequities, human biases, under-representation of minorities, etc. Our goal is to certify that models produced by a learning algorithm are pointwise-robust to potential dataset biases. This is a challenging problem: it entails learning models for a large, or even infinite, number of datasets, ensuring that they all produce the same prediction. We focus on decision-tree learning due to the interpretable nature of the models. Our approach allows programmatically specifying bias models across a variety of dimensions (e.g., missing data for minorities), composing types of bias, and targeting bias towards a specific group. To certify robustness, we use a novel symbolic technique to evaluate a decision-tree learner on a large, or infinite, number of datasets, certifying that each and every dataset produces the same prediction for a specific test point. We evaluate our approach on datasets that are commonly used in the fairness literature, and demonstrate our approach's viability on a range of bias models.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 55434479-1c84-462c-9bae-1b6e694b334eCited by top-tier papers9
- BagFlip: A Certified Defense Against Data PoisoningYuhao Zhang, Aws Albarghouthi, Loris D'AntoniNeurIPS 2022 · 32 citations
- FARE: Provably Fair Representation Learning with Practical CertificatesNikola Jovanovic, Mislav Balunovic, Dimitar Iliev Dimitrov, Martin T. VechevICML 2023 · 21 citations
- Consistent Range Approximation for Fair Predictive ModelingJiongli Zhu, Sainyam Galhotra, Nazanin Sabri, Babak SalimiVLDB 2023 · 14 citations
- Monitoring Algorithmic FairnessThomas A. Henzinger, Mahyar Karimi, Konstantin Kueffner, Kaushik MallikCAV 2023 · 13 citations
- Synthesizing Fair Decision Trees via Iterative Constraint SolvingJingbo Wang, Yannan Li, Chao WangCAV 2022 · 11 citations
Builds on7
- AI2: Safety and Robustness Certification of Neural Networks with Abstract InterpretationTimon Gehr, Matthew Mirman, Dana Drachsler-Cohen, Petar Tsankov et al.S&P 2018 · 987 citations
- Certified Robustness to Label-Flipping Attacks via Randomized SmoothingElan Rosenfeld, Ezra Winston, Pradeep Ravikumar, J. Zico KolterICML 2020 · 182 citations
- Intrinsic Certified Robustness of Bagging against Data Poisoning AttacksJinyuan Jia, Xiaoyu Cao, Neil Zhenqiang GongAAAI 2021 · 155 citations
- Ensuring Fairness Beyond the Training DataDebmalya Mandal, Samuel Deng, Suman Jana, Jeannette M. Wing et al.NeurIPS 2020 · 68 citations
- Abstract Interpretation of Decision Tree Ensemble ClassifiersFrancesco Ranzato, Marco ZanellaAAAI 2020 · 50 citations
Related papers
- Social Bias Meets Data Bias: The Impacts of Labeling and Measurement Errors on Fairness CriteriaYiqiao Liao, Parinaz NaghizadehAAAI 2023 · 15 citations
- Confidential-PROFITT: Confidential PROof of FaIr Training of TreesAli Shahin Shamsabadi, Sierra Calanda Wyllie, Nicholas Franzese, Natalie Dullerud et al.ICLR 2023
- Proving data-poisoning robustness in decision treesSamuel Drews, Aws Albarghouthi, Loris D'AntoniPLDI 2020 · 19 citations
- Targeted Data-driven Regularization for Out-of-Distribution GeneralizationMohammad Mahdi Kamani, Sadegh Farhang, Mehrdad Mahdavi, James Z. WangKDD 2020 · 10 citations
- Multigroup RobustnessLunjia Hu, Charlotte Peale, Judy Hanwen ShenICML 2024 · 2 citations
