paper-with-me

홈 › Papers

SMFusion: Semantic-Preserving Fusion of Multimodal Medical Images for Enhanced Clinical Diagnosis

2025-05-18 · Haozhe Xiang, Han Zhang, Yu Cheng, Xiongwen Quan, Wanwan Huang

Multimodal medical image fusion plays a crucial role in medical diagnosis by integrating complementary information from different modalities to enhance image readability and clinical applicability. However, existing methods mainly follow computer vision standards for feature extraction and fusion strategy formulation, overlooking the rich semantic information inherent in medical images. To address this limitation, we propose a novel semantic-guided medical image fusion approach that, for the first time, incorporates medical prior knowledge into the fusion process. Specifically, we construct a publicly available multimodal medical image-text dataset, upon which text descriptions generated by BiomedGPT are encoded and semantically aligned with image features in a high-dimensional space via a semantic interaction alignment module. During this process, a cross attention based linear transformation automatically maps the relationship between textual and visual features to facilitate comprehensive learning. The aligned features are then embedded into a text-injection module for further feature-level fusion. Unlike traditional methods, we further generate diagnostic reports from the fused images to assess the preservation of medical information. Additionally, we design a medical semantic loss function to enhance the retention of textual cues from the source images. Experimental results on test datasets demonstrate that the proposed method achieves superior performance in both qualitative and quantitative evaluations while preserving more critical medical information.

📄 PDF Abstract BibTeX arXiv:2505.12251

Code (0)

등록된 구현이 없습니다.

Tasks

DiagnosticMedical Diagnosis

Methods 이 논문이 사용한 방법론

Softmax The Softmax output function transforms a previous layer's output into a vector of probabilities. It is commonly used for multiclass classification. Given an input vector $x$…
Attention 설명 없음

Similar Papers 제목 키워드 기반

A Text-Image Fusion Method with Data Augmentation Capabilities for Referring Medical Image Segmentation

2025-10-14 · Shurong Chai, Rahul Kumar JAIN, Rui Xu, Shaocong Mo 외 arxiv

Deep learning relies heavily on data augmentation to mitigate limited data, especially in medical imaging. Recent multimodal learning integrates text and images for segmentation, known as referring or text-guided image s…

Medical Image SegmentationData Augmentation

A Semantic-based Medical Image Fusion Approach

2019-06-01 · Fanda Fan, Yunyou Huang, Lei Wang, Xingwang Xiong 외

It is necessary for clinicians to comprehensively analyze patient information from different sources. Medical image fusion is a promising approach to providing overall information from medical images of different modalit…

An Attention-based Multi-Scale Feature Learning Network for Multimodal Medical Image Fusion

2022-12-09 · Meng Zhou, Xiaolan Xu, Yuxuan Zhang

Medical images play an important role in clinical applications. Multimodal medical images could provide rich information about patients for physicians to diagnose. The image fusion technique is able to synthesize complem…

Diagnostic

MIND: Multimodal Intent-Driven Network via Diffusion Transformers for Medical Image Fusion

2026-07-30 · Yunzhan Fu, Xiangyu Shen, Yifei Sun, Yuhan Chen 외 arxiv

Medical image fusion aims to integrate complementary information from diverse imaging modalities to support clinical diagnosis. Existing methods typically apply uniform fusion rules globally, lacking a deep understanding…

Brain Tumor Segmentation

Multi-modal Medical Neurological Image Fusion using Wavelet Pooled Edge Preserving Autoencoder

2023-10-18 · Manisha Das, Deep Gupta, Petia Radeva, Ashwini M Bakde

Medical image fusion integrates the complementary diagnostic information of the source image modalities for improved visualization and analysis of underlying anomalies. Recently, deep learning-based models have excelled …

Diagnosticfeature selection