Disclosure-Compliant Query Answering
Rudi Poepsel Lemaitre, Kaustubh Beedkar, Volker Markl
Abstract
In today's data-driven world, organizations face increasing pressure to comply with data disclosure policies, which require data masking measures and robust access control mechanisms. This paper presents Mascara, a middleware for specifying and enforcing data disclosure policies. Mascara extends traditional access control mechanisms with data masking to support partial disclosure of sensitive data. We introduce data masks to specify disclosure policies flexibly and intuitively and propose a query modification approach to rewrite user queries into disclosure-compliant ones. We present a utility estimation framework to estimate the information loss of masked data based on relative entropy, which Mascara leverages to select the disclosure-compliant query that minimizes information loss. Our experimental evaluation shows that Mascara effectively chooses the best disclosure-compliant query with a success rate exceeding 90%, ensuring users get data with the lowest possible information loss. Additionally, Mascara's overhead compared to normal execution without data protection is negligible, staying lower than 300ms even for extreme scenarios with hundreds of possible disclosure-compliant queries.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 629f2918-c22d-4ae2-84cd-685e43a71d21Cited by top-tier papers2
- Aegis: A Correlation-Based Data Masking Advisor for Data Sharing EcosystemsOmar Islam Laskar, Fatemeh Ramezani Khozestani, Ishika Nankani, Sohrab Namazi Nia et al.SIGMOD 2026
- Algorithmic Data Minimization for Machine Learning over Internet-of-Things Data StreamsTed Shaowang, Shinan Liu, Jonatas Marques, Nick Feamster et al.VLDB 2025
Builds on12
- Retiring Adult: New Datasets for Fair Machine LearningFrances Ding, Moritz Hardt, John Miller, Ludwig SchmidtNeurIPS 2021 · 671 citations
- Cardinality Estimation in DBMS: A Comprehensive Benchmark EvaluationYuxing Han, Ziniu Wu, Peizhi Wu, Rong Zhu et al.VLDB 2022 · 169 citations
- FLAT: Fast, Lightweight and Accurate Method for Cardinality EstimationRong Zhu, Ziniu Wu, Yuxing Han, Kai Zeng et al.VLDB 2021 · 120 citations
- Robust Query Driven Cardinality Estimation under Changing WorkloadsParimarjan Negi, Ziniu Wu, Andreas Kipf, Nesime Tatbul et al.VLDB 2023 · 88 citations
- FactorJoin: A New Cardinality Estimation Framework for Join QueriesZiniu Wu, Parimarjan Negi, Mohammad Alizadeh, Tim Kraska et al.SIGMOD 2023 · 54 citations
Related papers
- Data Guard: A Fine-Grained Purpose-Based Access Control System for Large Data WarehousesKhai Tran, Sudarshan Vasudevan, Pratham Desai, Alex Gorelik et al.ICDE 2026
- On Optimizing the Trade-off between Privacy and Utility in Data ProvenanceDaniel Deutch, Ariel Frankenthal, Amir Gilad, Yuval MoskovitchSIGMOD 2021 · 15 citations
- Don't Be a Tattle-Tale: Preventing Leakages through Data Dependencies on Access Control Protected DataPrimal Pappachan, Shufan Zhang, Xi He, Sharad MehrotraVLDB 2022 · 14 citations
- Shedding Light on Opaque Application QueriesKapil Khurana, Jayant R. HaritsaSIGMOD 2021 · 3 citations
- RedacBench: Can AI Erase Your Secrets?Hyunjun Jeon, Kyuyoung Kim, Jinwoo ShinICLR 2026 · 2 citations
