Difference-Aware Decision Learning for Multimodal Image Fusion
Hao Pan, Jian Dai, Yuan Sun, Zhenwen Ren, Xingfeng Li
摘要
Multimodal image fusion aims to integrate complementary information from different modalities, but cross-modal discrepancies and local conflicts often make modality allocation uncertain, causing information loss or artifact propagation. We address this problem by formulating fusion as an observation-conditioned probabilistic decision-learning problem, where local modality contribution is explicitly modeled as a decision variable. Based on this view, we propose a dIfference-aware Decision-lEArning muLtimodal image fusion paradigm (IDEAL). IDEAL uses cross-modal differences as decision triggers and constructs spatial and spectral decision conditions from multi-scale difference attention, power-spectrum energy, complementary spectra, and spectral-entropy reliability. These conditions are mapped to interpretable contribution policies through a symmetric Beta prior, while uncertainty modulation pulls unreliable decisions toward conservative mixing when evidence is insufficient. Extensive experiments on multiple fusion tasks demonstrate stable and competitive performance against state-of-the-art methods. Code is available at: https://github.com/Pon915/IDEAL-main.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper20
- Target-aware Dual Adversarial Learning and a Multi-scenario Multi-Modality Benchmark to Fuse Infrared and Visible for Object DetectionJinyuan Liu, Xin Fan, Zhanbo Huang, Guanyao Wu 等CVPR 2022 · 被引用 929 次
- DDFM: Denoising Diffusion Model for Multi-Modality Image FusionZixiang Zhao, Haowen Bai, Yuanzhi Zhu, Jiangshe Zhang 等ICCV 2023 · 被引用 350 次
- Multi-interactive Feature Learning and a Full-time Multi-modality Benchmark for Image Fusion and SegmentationJinyuan Liu, Zhu Liu, Guanyao Wu, Long Ma 等ICCV 2023 · 被引用 287 次
- Equivariant Multi-Modality Image FusionZixiang Zhao, Haowen Bai, Jiangshe Zhang, Yulun Zhang 等CVPR 2024 · 被引用 155 次
- Highly-efficient Incomplete Largescale Multiview Clustering with Consensus Bipartite GraphSiwei Wang, Xinwang Liu, Li Liu, Wenxuan Tu 等CVPR 2022 · 被引用 134 次
相关 Paper
- Label What Matters: Modality-Balanced and Difficulty-Aware Multimodal Active LearningYuqiao Zeng, Xu Wang, Tengfei Liang, Yiqing Hao 等CVPR 2026
- DetFusion: A Detection-driven Infrared and Visible Image Fusion NetworkYiming Sun, Bing Cao, Pengfei Zhu, Qinghua HuACM MM 2022 · 被引用 165 次
- CMoB: Modality Valuation via Causal Effect for Balanced Multimodal LearningJun Wang, Fuyuan Cao, Zhixin Xue, Xingwang Zhao 等NeurIPS 2025 · 被引用 4 次
- Multi-modal Gated Mixture of Local-to-Global Experts for Dynamic Image FusionBing Cao, Yiming Sun, Pengfei Zhu, Qinghua HuICCV 2023 · 被引用 110 次
- Detached and Interactive Multimodal LearningYunfeng Fan, Wenchao Xu, Haozhao Wang, Junhong Liu 等ACM MM 2024 · 被引用 4 次
