Hierarchical Reinforcement Learning for Integrated Recommendation
Ruobing Xie, Shaoliang Zhang, Rui Wang, Feng Xia, Leyu Lin
摘要
Integrated recommendation aims to jointly recommend heterogeneous items in the main feed from different sources via multiple channels, which needs to capture user preferences on both item and channel levels. It has been widely used in practical systems by billions of users, while few works concentrate on the integrated recommendation systematically. In this work, we propose a novel Hierarchical reinforcement learning framework for integrated recommendation (HRL-Rec), which divides the integrated recommendation into two tasks to recommend channels and items sequentially. The low-level agent is a channel selector, which generates a personalized channel list. The high-level agent is an item recommender, which recommends specific items from heterogeneous channels under the channel constraints. We design various rewards for both recommendation accuracy and diversity, and propose four losses for fast and stable model convergence. We also conduct an online exploration for sufficient training. In experiments, we conduct extensive offline and online experiments on a billion-level real-world dataset to show the effectiveness of HRL-Rec. HRL-Rec has also been deployed on WeChat Top Stories, affecting millions of users. The source codes are released in https://github.com/modriczhang/HRL-Rec . * indicates equal contribution. Ruobing Xie is the corresponding author (
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了最后一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper12
- Curriculum Disentangled Recommendation with Noisy Multi-feedbackHong Chen, Yudong Chen, Xin Wang, Ruobing Xie 等NeurIPS 2021 · 被引用 88 次
- Hierarchical Diffusion for Offline Decision MakingWenhao Li, Xiangfeng Wang, Bo Jin, Hongyuan ZhaICML 2023 · 被引用 80 次
- Cross DQN: Cross Deep Q Network for Ads Allocation in FeedGuogang Liao, Ze Wang, Xiaoxu Wu, Xiaowen Shi 等WWW 2022 · 被引用 46 次
- Personalized Approximate Pareto-Efficient RecommendationRuobing Xie, Yanlei Liu, Shaoliang Zhang, Rui Wang 等WWW 2021 · 被引用 46 次
- Controlling Underestimation Bias in Reinforcement Learning via Quasi-median OperationWei Wei, Yujia Zhang, Jiye Liang, Lin Li 等AAAI 2022 · 被引用 20 次
它引用的顶会 Paper3
- Self-Supervised Reinforcement Learning for Recommender SystemsXin Xin, Alexandros Karatzoglou, Ioannis Arapakis, Joemon M. JoseSIGIR 2020 · 被引用 217 次
- Adaptive Factorization Network: Learning Adaptive-Order Feature InteractionsWeiyu Cheng, Yanyan Shen, Linpeng HuangAAAI 2020 · 被引用 202 次
- MaHRL: Multi-goals Abstraction Based Deep Hierarchical Reinforcement Learning for RecommendationsDongyang Zhao, Liang Zhang, Bo Zhang, Lizhou Zheng 等SIGIR 2020 · 被引用 33 次
相关 Paper
- DEAR: Deep Reinforcement Learning for Online Advertising Impression in Recommender SystemsXiangyu Zhao, Changsheng Gu, Haoshenglun Zhang, Xiwang Yang 等AAAI 2021 · 被引用 131 次
- Deep Unified Representation for Heterogeneous RecommendationChengqiang Lu, Mingyang Yin, Shuheng Shen, Luo Ji 等WWW 2022 · 被引用 9 次
- HieRec: Hierarchical User Interest Modeling for Personalized News RecommendationTao Qi, Fangzhao Wu, Chuhan Wu, Peiru Yang 等ACL 2021
- Dual Contrastive Transformer for Hierarchical Preference Modeling in Sequential RecommendationChengkai Huang, Shoujin Wang, Xianzhi Wang, Lina YaoSIGIR 2023 · 被引用 17 次
- Package Recommendation with Intra- and Inter-Package Attention NetworksChen Li, Yuanfu Lu, Wei Wang, Chuan Shi 等SIGIR 2021 · 被引用 15 次
