Contrastive Intra- and Inter-Modality Generation for Enhancing Incomplete Multimedia Recommendation
Zhenghong Lin, Yanchao Tan, Yunfei Zhan, Weiming Liu, Fan Wang, Chaochao Chen, Shiping Wang, Carl Yang
摘要
With the rapid growth of multimedia-sharing platforms (e.g. Twitter and TikTok), multimedia recommender systems have become fundamental for helping users alleviate information overload and discover items of interest. Existing multimedia recommendation methods often incorporate various auxiliary modalities (e.g., visual, textual, and acoustic) to describe item characteristics and improve task performance. However, these methods usually assume that each item is associated with complete modalities, ignoring the prevalence of missing modality issues in real-world scenarios. To deal with the challenge of missing modalities, in this paper, we propose a novel framework of Contrastive Intra- and Inter-Modality Generation (CI2MG) for enhancing incomplete multimedia recommendation. We first develop a contrastive intra- and inter-modality generation module for the missing modalities, where the intra-modality representation is updated through clustering-based hypergraph convolution and inter-modality representation is obtained by optimal transport between different modalities. To tackle the challenge of insufficient and incomplete supervision labels during intra- and inter-modality generation, a modality-aware contrastive learning paradigm is introduced based on an augmentation between the intra-modality view and inter-modality view. Furthermore, to learn task-related representations from the generative modalities and further improve the performance of recommendation, we design an enhanced multimedia recommendation module to alleviate the influences driven by task-irrelevant noise. Extensive experiments on real-world datasets show the superiority of our proposed CI2MG framework in offering great potential for personalized multimedia recommendation over the state-of-the-art baselines regarding Recall, NDCG, and Precision metrics.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper7
- Generating with Fairness: A Modality-Diffused Counterfactual Framework for Incomplete Multimodal RecommendationsJin Li, Shoujin Wang, Qi Zhang, Shui Yu 等WWW 2025 · 被引用 26 次
- Jointly Modeling Inter- & Intra-Modality Dependencies for Multi-modal LearningDivyam Madaan, Taro Makino, Sumit Chopra, Kyunghyun ChoNeurIPS 2024 · 被引用 19 次
- Disentangling and Generating Modalities for Recommendation in Missing Modality ScenariosJiwan Kim, Hongseok Kang, Sein Kim, Kibum Kim 等SIGIR 2025 · 被引用 8 次
- LargeMvC-Net: Anchor-based Deep Unfolding Network for Large-scale Multi-view ClusteringShide Du, Chunming Wu, Zihan Fang, Wendi Zhao 等ACM MM 2025 · 被引用 7 次
- MedAlign: Enhancing Combinatorial Medication Recommendation with Multi-modality AlignmentHang Lv, Zixuan Guo, Zijie Wu, Yanchao Tan 等ACM MM 2025 · 被引用 4 次
它引用的顶会 Paper24
- LightGCN: Simplifying and Powering Graph Convolution Network for RecommendationXiangnan He, Kuan Deng, Xiang Wang, Yan Li 等SIGIR 2020 · 被引用 4,448 次
- Self-supervised Graph Learning for RecommendationJiancan Wu, Xiang Wang, Fuli Feng, Xiangnan He 等SIGIR 2021 · 被引用 1,476 次
- Revisiting Graph Based Collaborative Filtering: A Linear Residual Graph Convolutional Network ApproachLei Chen, Le Wu, Richang Hong, Kun Zhang 等AAAI 2020 · 被引用 634 次
- Improving Graph Collaborative Filtering with Neighborhood-enriched Contrastive LearningZihan Lin, Changxin Tian, Yupeng Hou, Wayne Xin ZhaoWWW 2022 · 被引用 606 次
- Image-Adaptive YOLO for Object Detection in Adverse Weather ConditionsWenyu Liu, Gaofeng Ren, Runsheng Yu, Shi Guo 等AAAI 2022 · 被引用 556 次
相关 Paper
- Multi-Modal Self-Supervised Learning for RecommendationWei Wei, Chao Huang, Lianghao Xia, Chuxu ZhangWWW 2023 · 被引用 256 次
- DiffMM: Multi-Modal Diffusion Model for RecommendationYangqin Jiang, Lianghao Xia, Wei Wei, Da Luo 等ACM MM 2024 · 被引用 92 次
- STARLINE: Contrastive Learning with Modality-Aware Graph Refinement for Effective Multimedia RecommendationTaeri Kim, Sohee Ban, Hyunjoon Kim, Sang-Wook KimKDD 2025 · 被引用 1 次
- Multimodality Invariant Learning for Multimedia-Based New Item RecommendationHaoyue Bai, Le Wu, Min Hou, Miaomiao Cai 等SIGIR 2024 · 被引用 30 次
- PROMISE: Prompt-Attentive Hierarchical Contrastive Learning for Robust Cross-Modal Representation with Missing ModalitiesJiajun Chen, Sai Cheng, Yutao Yuan, Yirui Zhang 等AAAI 2026 · 被引用 1 次
