paper-with-me

Papers

Incomplete Modality Disentangled Representation for Ophthalmic Disease Grading and Diagnosis

2025-02-17 · Chengzhi Liu, Zile Huang, Zhe Chen, Feilong Tang, Yu Tian, Zhongxing Xu, Zihong Luo, Yalin Zheng, Yanda Meng

Ophthalmologists typically require multimodal data sources to improve diagnostic accuracy in clinical decisions. However, due to medical device shortages, low-quality data and data privacy concerns, missing data modalities are common in real-world scenarios. Existing deep learning methods tend to address it by learning an implicit latent subspace representation for different modality combinations. We identify two significant limitations of these methods: (1) implicit representation constraints that hinder the model's ability to capture modality-specific information and (2) modality heterogeneity, causing distribution gaps and redundancy in feature representations. To address these, we propose an Incomplete Modality Disentangled Representation (IMDR) strategy, which disentangles features into explicit independent modal-common and modal-specific features by guidance of mutual information, distilling informative knowledge and enabling it to reconstruct valuable missing semantics and produce robust multimodal representations. Furthermore, we introduce a joint proxy learning module that assists IMDR in eliminating intra-modality redundancy by exploiting the extracted proxies from each class. Experiments on four ophthalmology multimodal datasets demonstrate that the proposed IMDR outperforms the state-of-the-art methods significantly.

📄 PDF Abstract BibTeX arXiv:2502.11724

Code (0)

등록된 구현이 없습니다.

Tasks

Diagnostic

Similar Papers 제목 키워드 기반

Robust Multimodal Learning for Ophthalmic Disease Grading via Disentangled Representation

2025-03-07 · Xinkun Wang, Yifang Wang, Senwei Liang, Feilong Tang 외

This paper discusses how ophthalmologists often rely on multimodal data to improve diagnostic accuracy. However, complete multimodal data is rare in real-world applications due to a lack of medical equipment and concerns…

DiagnosticDisentanglementfeature selectionRepresentation Learning

Robust Incomplete-Modality Alignment for Ophthalmic Disease Grading and Diagnosis via Labeled Optimal Transport

2025-07-07 · Qinkai Yu, Jianyang Xie, Yitian Zhao, Cheng Chen 외 arxiv

Multimodal ophthalmic imaging-based diagnosis integrates color fundus image with optical coherence tomography (OCT) to provide a comprehensive view of ocular pathologies. However, the uneven global distribution of health…

VisionFM: a Multi-Modal Multi-Task Vision Foundation Model for Generalist Ophthalmic Artificial Intelligence

2023-10-08 · Jianing Qiu, Jian Wu, Hao Wei, Peilun Shi 외

We present VisionFM, a foundation model pre-trained with 3.4 million ophthalmic images from 560,457 individuals, covering a broad range of ophthalmic diseases, modalities, imaging devices, and demography. After pre-train…

Disease PredictionPrognosisRepresentation Learning

EyeFound: A Multimodal Generalist Foundation Model for Ophthalmic Imaging

2024-05-18 · Danli Shi, Weiyi Zhang, Xiaolan Chen, Yexin Liu 외

Artificial intelligence (AI) is vital in ophthalmology, tackling tasks like diagnosis, classification, and visual question answering (VQA). However, existing AI models in this domain often require extensive annotation an…

Question AnsweringVisual Question AnsweringVisual Question Answering (VQA)

EyeCLIP: A visual-language foundation model for multi-modal ophthalmic image analysis

2024-09-10 · Danli Shi, Weiyi Zhang, Jiancheng Yang, Siyu Huang 외

Early detection of eye diseases like glaucoma, macular degeneration, and diabetic retinopathy is crucial for preventing vision loss. While artificial intelligence (AI) foundation models hold significant promise for addre…

Contrastive LearningCross-Modal RetrievalQuestion AnsweringVisual Question Answering