Efficient Policy Evaluation Across Multiple Different Experimental Datasets
Yonghan Jung, Alexis Bellot
摘要
Artificial intelligence systems are trained combining various observational and experimental datasets from different source sites, and are increasingly used to reason about the effectiveness of candidate policies. One common assumption in this context is that the data in source and target sites (where the candidate policy is due to be deployed) come from the same distribution. This assumption is often violated in practice, causing challenges for generalization, transportability, or external validity. Despite recent advances for determining the identifiability of the effectiveness of policies in a target domain, there are still challenges for the accurate estimation of effects from finite samples. In this paper, we develop novel graphical criteria and estimators for evaluating the effectiveness of policies ( e.g. , conditional, stochastic) by combining data from multiple experimental studies. Asymptotic error analysis of our estimators provides fast convergence guarantee. We empirically verified the robustness of estimators through simulations.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper4
- Structural Causal Bandits under Markov EquivalenceMin Woo Park, Andy Arditi, Elias Bareinboim, Sanghack LeeNeurIPS 2025 · 被引用 3 次
- Pessimistic Data Integration for Policy EvaluationXiangkun Wu, Ting Li, Gholamali Aminian, Armin Behnamnia 等NeurIPS 2025 · 被引用 2 次
- Counterfactual Structural Causal BanditsMin Woo Park, Sanghack LeeICLR 2026 · 被引用 1 次
- Designing Time Series Experiments in A/B Testing with Transformer Reinforcement LearningXiangkun Wu, Qianglin Wen, Yingying Zhang, Hongtu Zhu 等ICLR 2026 · 被引用 1 次
它引用的顶会 Paper9
- Off-Policy Evaluation in Partially Observable EnvironmentsGuy Tennenholtz, Uri Shalit, Shie MannorAAAI 2020 · 被引用 91 次
- Off-Policy Evaluation and Learning for External Validity under a Covariate ShiftMasatoshi Uehara, Masahiro Kato, Shota YasuiNeurIPS 2020 · 被引用 60 次
- General Transportability of Soft Interventions: Completeness ResultsJuan D. Correa, Elias BareinboimNeurIPS 2020 · 被引用 40 次
- General Transportability - Synthesizing Observations and Experiments from Heterogeneous DomainsSanghack Lee, Juan D. Correa, Elias BareinboimAAAI 2020 · 被引用 21 次
- Estimating Identifiable Causal Effects on Markov Equivalence Class through Double Machine LearningYonghan Jung, Jin Tian, Elias BareinboimICML 2021 · 被引用 21 次
相关 Paper
- Counterfactual Transportability: A Formal ApproachJuan D. Correa, Sanghack Lee, Elias BareinboimICML 2022 · 被引用 8 次
- Towards Estimating Bounds on the Effect of Policies under Unobserved ConfoundingAlexis Bellot, Silvia ChiappaNeurIPS 2024 · 被引用 6 次
- Towards Safe Policy Learning under Partial Identifiability: A Causal ApproachShalmali Joshi, Junzhe Zhang, Elias BareinboimAAAI 2024 · 被引用 10 次
- Falsification before Extrapolation in Causal Effect EstimationZeshan M. Hussain, Michael Oberst, Ming-Chieh Shih, David A. SontagNeurIPS 2022 · 被引用 11 次
- Partial Transportability for Domain GeneralizationKasra Jalaldoust, Alexis Bellot, Elias BareinboimNeurIPS 2024 · 被引用 14 次
