SACMFuse: Structure-Aware Cross-Modal Interaction Network for Multi-Modal Image Fusion
Multi-modal image fusion integrates complementary information from different modalities to generate a unified representation that is informative for human perception and beneficial to downstream vision tasks. However, existing methods often inefficiently model global features and their cross-modal interaction is insuff...