Listwise Preference Diffusion Optimization for User Behavior Trajectories Prediction
Hongtao Huang, Chengkai Huang, Junda Wu, Tong Yu, Julian J. McAuley, Lina Yao
摘要
Forecasting multi-step user behavior trajectories requires reasoning over structured preferences across future actions, a challenge overlooked by traditional sequential recommendation. This problem is critical for applications such as personalized commerce and adaptive content delivery, where anticipating a user's complete action sequence enhances both satisfaction and business outcomes. We identify an essential limitation of existing paradigms: their inability to capture global, listwise dependencies among sequence items. To address this, we formulate User Behavior Trajectory Prediction (UBTP) as a new task setting that explicitly models long-term user preferences. We introduce Listwise Preference Diffusion Optimization (LPDO), a diffusion-based training framework that directly optimizes structured preferences over entire item sequences. LPDO incorporates a Plackett-Luce supervision signal and derives a tight variational lower bound aligned with listwise ranking likelihoods, enabling coherent preference generation across denoising steps and overcoming the independent-token assumption of prior diffusion methods. To rigorously evaluate multi-step prediction quality, we propose the task-specific metric Sequential Match (SeqMatch), which measures exact trajectory agreement, and adopt Perplexity (PPL), which assesses probabilistic fidelity. Extensive experiments on real-world user behavior benchmarks demonstrate that LPDO consistently outperforms state-of-the-art baselines, establishing a new benchmark for structured preference learning with diffusion models.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper3
- PruneRAG: Confidence-Guided Query Decomposition Trees for Efficient Retrieval-Augmented GenerationShuguang Jiao, Xinyu Xiao, Yunfan Wei, Shuhan Qi 等WWW 2026 · 被引用 2 次
- WS-GRPO: Weakly-Supervised Group-Relative Policy Optimization for Rollout-Efficient ReasoningGagan Mundada, Zihan Huang, Rohan Surana, Sheldon Yu 等ICML 2026
- Factorized Latent Reasoning for LLM-based RecommendationTianqi Gao, Chengkai Huang, Zihan Wang, Cao Liu 等SIGIR 2026
它引用的顶会 Paper12
- Denoising Diffusion Probabilistic ModelsJonathan Ho, Ajay Jain, Pieter AbbeelNeurIPS 2020 · 被引用 35,902 次
- Diffusion-LM Improves Controllable Text GenerationXiang Lisa Li, John Thickstun, Ishaan Gulrajani, Percy Liang 等NeurIPS 2022 · 被引用 1,546 次
- On Sampled Metrics for Item RecommendationWalid Krichene, Steffen RendleKDD 2020 · 被引用 459 次
- Generate What You Prefer: Reshaping Sequential Recommendation via Guided DiffusionZhengyi Yang, Jiancan Wu, Zhicai Wang, Xiang Wang 等NeurIPS 2023 · 被引用 205 次
- Sequential Recommendation via Stochastic Self-AttentionZiwei Fan, Zhiwei Liu, Yu Wang, Alice Wang 等WWW 2022 · 被引用 203 次
相关 Paper
- Towards Better Optimization For Listwise Preference in Diffusion ModelsJiamu Bai, Xin Yu, Meilong Xu, Weitao Lu 等ICLR 2026 · 被引用 8 次
- Beyond Static Diffusion: Explicitly Modeling Temporal Patterns in Sequential RecommendationYao Wu, Chengyi Liu, Wenqi Fan, Rui ZhangSIGIR 2026
- Diffused Task-Agnostic Milestone PlannerMineui Hong, Minjae Kang, Songhwai OhNeurIPS 2023 · 被引用 15 次
- Unleashing the Potential of Diffusion Models Towards Diversified Sequential RecommendationsZhuo Cai, Shoujin Wang, Victor W. Chu, Usman Naseem 等SIGIR 2025 · 被引用 7 次
- Planning with Diffusion Models for Target-Oriented Dialogue SystemsHanwen Du, Bo Peng, Xia NingACL 2025
