Efficient Perceiving Local Details via Adaptive Spatial-Frequency Information Integration for Multi-focus Image Fusion
Jingjia Huang, Jingyan Tu, Ge Meng, Yingying Wang, Yuhang Dong, Xiaotong Tu, Xinghao Ding, Yue Huang
Abstract
Multi-focus image fusion (MFIF) aims to combine multiple images with different focused regions into a single all-in-focus image. Existing unsupervised deep learning-based methods only fuse structural information of images in the spatial domain, neglecting potential solutions from the frequency domain exploration. In this paper, we make the first attempt to integrate spatial-frequency information to achieve high-quality MFIF. We propose a novel unsupervised spatial-frequency interaction MFIF network named SFIMFN, which consists of three key components: Adaptive Frequency Domain Information Interaction Module (AFIM), Ret-Attention-Based Spatial Information Extraction Module (RASEM), and Invertible Dual-domain Feature Fusion Module (IDFM). Specifically, in AFIM, we interactively explore global contextual information by combining the amplitude and phase information of multiple images separately. In RASEM, we design a customized transformer to encourage the network to capture important local high-frequency information by redesigning the self-attention mechanism with a bidirectional, two-dimensional form of explicit decay. Finally, we employ IDFM to fuse spatial-frequency information without information loss to generate the desired all-in-focus image. Extensive experiments on different datasets demonstrate that our method significantly outperforms state-of-the-art unsupervised methods in terms of qualitative and quantitative metrics as well as the generalization ability.
Ask about this paper
Ask your agent about it.
Lune has read the top-tier papers around this one, so every answer names the papers it rests on.
Cited by top-tier papers2
- LSFDNet: A Single-Stage Fusion and Detection Network for Ships Using SWIR and LWIRYanyin Guo, Runxuan An, Junwei Li, Zhiyuan ZhangACM MM 2025 · 2 citations
- One Model for ALL: Low-Level Task Interaction Is a Key to Task-Agnostic Image FusionChunyang Cheng, Tianyang Xu, Zhenhua Feng, Xiaojun Wu et al.CVPR 2025
Related papers
- Multi-Focus Image Fusion via Explicit Defocus Blur ModellingYuhui Quan, Xi Wan, Zitao Tang, Jinxiu Liang et al.AAAI 2025 · 12 citations
- Pyramid Dual Domain Injection Network for Pan-sharpeningXuanhua He, Keyu Yan, Rui Li, Chengjun Xie et al.ICCV 2023 · 15 citations
- Residual Prior-driven Frequency-aware Network for Image FusionZheng Guan, Xue Wang, Wenhua Qian, Peng Liu et al.ACM MM 2025 · 10 citations
- Wavelet-Assisted Multi-Frequency Attention Network for PansharpeningJie Huang, Rui Huang, Jinghao Xu, Siran Peng et al.AAAI 2025 · 36 citations
- Revisiting Spatial-Frequency Information Integration from a Hierarchical Perspective for Panchromatic and Multi-Spectral Image FusionJiangtong Tan, Jie Huang, Naishan Zheng, Man Zhou et al.CVPR 2024 · 27 citations
