Towards Multimodal Continual Knowledge Embedding wth Modality Forgetting Modulation
Xiaowen Jiang, Jing Yang, Shundong Yang, Yuan Gao, Xinfa Jiang, Laurence Tianruo Yang, Jieming Yang
Abstract
The continuous emergence of new entities, relations, triples, and multimodal information drives the dynamic evolution of multimodal knowledge graph (MMKG). However, existing MMKG embedding models follow a static setting, where training from scratch for growing MMKG wastes learned knowledge, while fine-tuning on new knowledge easily leads to catastrophic forgetting, severely limiting their applicability in real-world scenarios. To address this, we propose a multimodal continual representation learning framework (MoFot) for growing MMKG. Unlike existing static multimodal embedding methods, MoFot focuses on alleviating catastrophic forgetting rather than retraining to adapt to new knowledge. Specifically, MoFot effectively mitigates catastrophic forgetting caused by parameter updates and differing forgetting rates across modalities through a multimodal collaborative modulation mechanism. The mechanism ensures consistent retention of previously learned multimodal knowledge across snapshots through multimodal weight modulation and multimodal feature modulation. MoFot outperforms existing MMKG embedding, KG continual learning, and MMKG inductive models. Experimental results demonstrate that MoFot not only avoids forgetting but also enhances old knowledge by learning new knowledge, achieving adaptation to new knowledge while mitigating forgetting of old knowledge.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Builds on9
- Neural Bellman-Ford Networks: A General Graph Neural Network Framework for Link PredictionZhaocheng Zhu, Zuobai Zhang, Louis-Pascal A. C. Xhonneux, Jian TangNeurIPS 2021 · 546 citations
- Hybrid Transformer with Multi-level Fusion for Multimodal Knowledge Graph CompletionXiang Chen, Ningyu Zhang, Lei Li, Shumin Deng et al.SIGIR 2022 · 227 citations
- IMF: Interactive Multimodal Fusion Model for Link PredictionXinhang Li, Xiangyu Zhao, Jiaxing Xu, Yong Zhang et al.WWW 2023 · 113 citations
- TIVA-KG: A Multimodal Knowledge Graph with Text, Image, Video and AudioXin Wang, Benyuan Meng, Hong Chen, Yuan Meng et al.ACM MM 2023 · 71 citations
- Lifelong Embedding Learning and Transfer for Growing Knowledge GraphsYuanning Cui, Yuxin Wang, Zequn Sun, Wenqiang Liu et al.AAAI 2023 · 57 citations
Related papers
- Towards Dynamic Modality Alignment in Multimodal Continual LearningJiayao Tan, Fan Lyu, Tianle Liu, Fuyuan Hu et al.CVPR 2026
- Disentangle-based Continual Graph Representation LearningXiaoyu Kou, Yankai Lin, Shaobo Liu, Peng Li et al.EMNLP 2020 · 26 citations
- From Knowledge Forgetting to Accumulation: Evolutionary Relation Path Passing for Lifelong Knowledge Graph EmbeddingJing Yang, Xinfa Jiang, Xiaowen Jiang, Yuan Gao et al.SIGIR 2025 · 2 citations
- Multi-Faceted Continual Knowledge Graph Embedding for Semantic-Aware Link PredictionJing Qi, Yuxiang Wang, Zhiyuan Yu, Xiaoliang Xu et al.SIGIR 2026
- Knowledge Graph Enhanced Generative Multi-modal Models for Class-Incremental LearningXusheng Cao, Haori Lu, Linlan Huang, Fei Yang et al.NeurIPS 2025 · 3 citations
