Mutual-Enhanced Incongruity Learning Network for Multi-Modal Sarcasm Detection
Yang Qiao, Liqiang Jing, Xuemeng Song, Xiaolin Chen, Lei Zhu, Liqiang Nie
摘要
Sarcasm is a sophisticated linguistic phenomenon that is prevalent on today's social media platforms. Multi-modal sarcasm detection aims to identify whether a given sample with multi-modal information (i.e., text and image) is sarcastic. This task's key lies in capturing both inter- and intra-modal incongruities within the same context. Although existing methods have achieved compelling success, they are disturbed by irrelevant information extracted from the whole image and text, or overlooking some important information due to the incomplete input. To address these limitations, we propose a Mutual-enhanced Incongruity Learning Network for multi-modal sarcasm detection, named MILNet. In particular, we design a local semantic-guided incongruity learning module and a global incongruity learning module. Moreover, we introduce a mutual enhancement module to take advantage of the underlying consistency between the two modules to boost the performance. Extensive experiments on a widely-used dataset demonstrate the superiority of our model over cutting-edge methods.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper6
- Debiasing Multimodal Sarcasm Detection with Contrastive LearningMengzhao Jia, Can Xie, Liqiang JingAAAI 2024 · 被引用 51 次
- G^2SAM: Graph-Based Global Semantic Awareness Method for Multimodal Sarcasm DetectionYiwei Wei, Shaozu Yuan, Hengyang Zhou, Longbiao Wang 等AAAI 2024 · 被引用 30 次
- Multi-source Semantic Graph-based Multimodal Sarcasm Explanation GenerationLiqiang Jing, Xuemeng Song, Kun Ouyang, Mengzhao Jia 等ACL 2023 · 被引用 17 次
- Defeasible Visual Entailment: Benchmark, Evaluator, and Reward-Driven OptimizationYue Zhang, Liqiang Jing, Vibhav GogateAAAI 2025 · 被引用 13 次
- MMSD3.0: A Multi-Image Benchmark for Real-World Multimodal Sarcasm DetectionHaochen Zhao, Yuyao Kong, Yongxiu Xu, Gaopeng Gou 等CVPR 2026 · 被引用 4 次
它引用的顶会 Paper8
- Reasoning with Multimodal Sarcastic Tweets via Modeling Cross-Modality Contrast and Semantic AssociationNan Xu, Zhixiong Zeng, Wenji MaoACL 2020 · 被引用 153 次
- Multi-Modal Sarcasm Detection via Cross-Modal Graph Convolutional NetworkBin Liang, Chenwei Lou, Xiang Li, Min Yang 等ACL 2022 · 被引用 151 次
- Multi-Modal Sarcasm Detection with Interactive In-Modal and Cross-Modal GraphsBin Liang, Chenwei Lou, Xiang Li, Lin Gui 等ACM MM 2021 · 被引用 128 次
- Block Modeling-Guided Graph Convolutional Neural NetworksDongxiao He, Chundong Liang, Huixin Liu, Mingxiang Wen 等AAAI 2022 · 被引用 85 次
- Comprehensive Linguistic-Visual Composition Network for Image RetrievalHaokun Wen, Xuemeng Song, Xin Yang, Yibing Zhan 等SIGIR 2021 · 被引用 72 次
相关 Paper
- Towards Multi-Modal Sarcasm Detection via Hierarchical Congruity Modeling with Knowledge EnhancementHui Liu, Wenya Wang, Haoliang LiEMNLP 2022 · 被引用 91 次
- Incongruity-aware Tension Field Network for Multi-modal Sarcasm DetectionJiecheng Zhang, C. L. Philip Chen, Shuzhen Li, Tong ZhangACL 2025 · 被引用 2 次
- DIP: Dual Incongruity Perceiving Network for Sarcasm DetectionChangsong Wen, Guoli Jia, Jufeng YangCVPR 2023
- Sentiment-oriented Sarcasm Integration for Video Sentiment Analysis Enhancement with Sarcasm AssistanceJunlin Fang, Wenya Wang, Guosheng Lin, Fengmao LvACM MM 2024 · 被引用 4 次
- Multimodal Sarcasm Target Identification in TweetsJiquan Wang, Lin Sun, Yi Liu, Meizhi Shao 等ACL 2022 · 被引用 28 次
