DHMRec: Collaboration-Guided Multimodal Disentanglement and Hierarchical Fusion for Recommendation
Xiaohan Zhan, Yuliang Shi, Jihu Wang, Shijun Liu, Fanyu Kong, Zhiyong Chen
摘要
Multimodal recommender systems have emerged as a pivotal paradigm for harnessing diverse data modalities to deliver personalized services. Contemporary research predominantly focuses on integrating heterogeneous modality information through graph learning. However, these approaches face two key challenges: (1) the inherent complexity of modalities, characterized by entangled redundant signals and noise; and (2) the challenge of effectively integrating multimodal representations, each of which may exert varying degrees of influence on users' preferences. To address these challenges, we propose a novel Collaboration-Guided Multimodal Disentanglement and Hierarchical Fusion for Recommendation (DHMRec), which simultaneously achieves intra-modal denoising disentanglement and inter-modal hierarchical fusion. Specifically, we introduce a collaboration-related modality disentanglement module to distinguish between modality-common and modality-specific features. Then, through multi-view graph learning to capture both item-item dependencies and user-item interaction patterns. Additionally, we implement hierarchical fusion between the disentangled multimodal features and ID embeddings using a positive-negative attention-aware fusion module and an interaction distribution-based alignment module. Extensive experiments on three benchmarks demonstrate that our DHMRec surpasses various state-of-the-art baselines, highlighting its effectiveness in intra-modal disentanglement and multimodal features fusion.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper14
- LightGCN: Simplifying and Powering Graph Convolution Network for RecommendationXiangnan He, Kuan Deng, Xiang Wang, Yan Li 等SIGIR 2020 · 被引用 4,448 次
- AugMix: A Simple Data Processing Method to Improve Robustness and UncertaintyDan Hendrycks, Norman Mu, Ekin Dogus Cubuk, Barret Zoph 等ICLR 2020 · 被引用 1,572 次
- Graph-Refined Convolutional Network for Multimedia Recommendation with Implicit FeedbackYinwei Wei, Xiang Wang, Liqiang Nie, Xiangnan He 等ACM MM 2020 · 被引用 374 次
- Mining Latent Structures for Multimedia RecommendationJinghao Zhang, Yanqiao Zhu, Qiang Liu, Shu Wu 等ACM MM 2021 · 被引用 350 次
- A Tale of Two Graphs: Freezing and Denoising Graph Structures for Multimodal RecommendationXin Zhou, Zhiqi ShenACM MM 2023 · 被引用 234 次
相关 Paper
- Disentangling and Generating Modalities for Recommendation in Missing Modality ScenariosJiwan Kim, Hongseok Kang, Sein Kim, Kibum Kim 等SIGIR 2025 · 被引用 8 次
- COHESION: Composite Graph Convolutional Network with Dual-Stage Fusion for Multimodal RecommendationJinfeng Xu, Zheyu Chen, Wei Wang, Xiping Hu 等SIGIR 2025 · 被引用 20 次
- DIGEST: Dynamic Graph Refinement with Dual Contrastive Semantic Transfer for Multimodal RecommendationXiangyu Sai, Meysam Madadi, Sergio Escalera, Yong XuSIGIR 2026
- Disentangling Homophily and Heterophily in Multimodal Graph ClusteringZhaochen Guo, Zhixiang Shen, Xuanting Xie, Liangjian Wen 等ACM MM 2025 · 被引用 1 次
- Collaborative Diffusion Models for RecommendationMengru Chen, Lianghao Xia, Yong Xu, Ronghua LuoSIGIR 2025 · 被引用 3 次
