Optimizing Multi-Turn Interactive Recommendation Agents via Generative Intrinsic Motivation
Xueyang Feng, Jiakai Tang, Xu Chen, Quanyu Dai, Zhenhua Dong
摘要
Large language models have given rise to interactive recommendation agents (IRAs). Through proactive clarification, tool invocation, and dynamic dialogue, IRAs shift recommender systems from passive prediction to interactive, proactive intelligence. For training IRAs, agentic reinforcement learning offers a natural pathway, as it enables models to learn interactive capabilities directly from environmental feedback without requiring costly annotated data. However, this process faces three key challenges: credit assignment in multi-turn interactions, efficient exploration in large action spaces, and coordinated learning of multiple interactive skills.
问问这篇 Paper
问问你的智能体。
Lune 读过与它相关的顶会 Paper,每个回答都会注明依据哪几篇。
相关 Paper
- Action First: Leveraging Preference-Aware Actions for More Effective Decision-Making in Interactive Recommender SystemsRenting Rui, Yunjia Xi, Weiwen Liu, Jianghao Lin 等SIGIR 2025 · 被引用 1 次
- Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic OptimizationYihang Yao, Zhepeng Cen, Haohong Lin, Shiqi Liu 等ICML 2026
- Agentic Reinforcement Learning with Implicit Step RewardsXiaoqian Liu, Ke Wang, Yuchuan Wu, Fei Huang 等ICLR 2026 · 被引用 46 次
- AgentGym-RL: An Open-Source Framework to Train LLM Agents for Long-Horizon Decision Making via Multi-Turn RLZhiheng Xi, Jixuan Huang, Chenyang Liao, Baodai Huang 等ICLR 2026
- Aligning Large Language Models for Controllable RecommendationsWensheng Lu, Jianxun Lian, Wei Zhang, Guanghua Li 等ACL 2024 · 被引用 7 次
