Graph Diffusion Policy Optimization
Yijing Liu, Chao Du, Tianyu Pang, Chongxuan Li, Min Lin, Wei Chen
Abstract
Recent research has made significant progress in optimizing diffusion models for downstream objectives, which is an important pursuit in fields such as graph generation for drug design. However, directly applying these models to graph presents challenges, resulting in suboptimal performance. This paper introduces graph diffusion policy optimization (GDPO), a novel approach to optimize graph diffusion models for arbitrary (e.g., non-differentiable) objectives using reinforcement learning. GDPO is based on an eager policy gradient tailored for graph diffusion models, developed through meticulous analysis and promising improved performance. Experimental results show that GDPO achieves state-of-the-art performance in various graph generation tasks with complex and diverse objectives. Code is available at https://github.com/sail-sg/GDPO.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 446f5383-aa38-47ea-b44c-6c4cfafb7aadCited by top-tier papers10
- Multi-agent Coordination via Flow MatchingDongsu Lee, Daehee Lee, Amy ZhangICLR 2026 · 9 citations
- Graph-GRPO: Training Graph Flow Models with Reinforcement LearningBaoheng Zhu, Deyu Bo, Delvin Zhang, Xiao WangICML 2026 · 3 citations
- MolEditRL: Structure-Preserving Molecular Editing via Discrete Diffusion and Reinforcement LearningYuanxin Zhuang, Dazhong Shen, Ying SunICLR 2026 · 2 citations
- DMol: A Highly Efficient and Chemical Motif-Preserving Molecule Generation PlatformPeizhi Niu, Yu-Hsiang Wang, Vishal Rana, Chetan Rupakheti et al.NeurIPS 2025 · 1 citation
- MoE-Guided Graph Diffusion for Oriented Molecule DesignShuochen Li, Xiangqi Guo, Huobin Tan, Lei ShiAAAI 2026 · 1 citation
Builds on21
- Denoising Diffusion Probabilistic ModelsJonathan Ho, Ajay Jain, Pieter AbbeelNeurIPS 2020 · 35,902 citations
- Diffusion Models Beat GANs on Image SynthesisPrafulla Dhariwal, Alexander Quinn NicholNeurIPS 2021 · 13,211 citations
- Direct Preference Optimization: Your Language Model is Secretly a Reward ModelRafael Rafailov, Archit Sharma, Eric Mitchell, Christopher D. Manning et al.NeurIPS 2023 · 10,924 citations
- Elucidating the Design Space of Diffusion-Based Generative ModelsTero Karras, Miika Aittala, Timo Aila, Samuli LaineNeurIPS 2022 · 3,959 citations
- Structured Denoising Diffusion Models in Discrete State-SpacesJacob Austin, Daniel D. Johnson, Jonathan Ho, Daniel Tarlow et al.NeurIPS 2021 · 2,256 citations
Related papers
- Training Diffusion Models with Reinforcement LearningKevin Black, Michael Janner, Yilun Du, Ilya Kostrikov et al.ICLR 2024 · 816 citations
- Uncertainty-Aware Multi-Objective Reinforcement Learning-Guided Diffusion Models for 3D De Novo Molecular DesignLianghong Chen, Dongkyu Eugene Kim, Mike Domaratzki, Pingzhao HuNeurIPS 2025 · 4 citations
- Diffuse, Sample, Project: Plug-And-Play Controllable Graph GenerationKartik Sharma, Srijan Kumar, Rakshit S. TrivediICML 2024 · 8 citations
- Flow Matching Policy GradientsDavid McAllister, Songwei Ge, Brent Yi, Chung Min Kim et al.ICLR 2026 · 103 citations
- Fine-Tuning Discrete Diffusion Models with Policy Gradient MethodsOussama Zekri, Nicolas BoulléNeurIPS 2025 · 42 citations
