paper-with-me

Papers

TextDiffSeg: Text-guided Latent Diffusion Model for 3d Medical Images Segmentation

2025-04-16 · Kangbo Ma

Diffusion Probabilistic Models (DPMs) have demonstrated significant potential in 3D medical image segmentation tasks. However, their high computational cost and inability to fully capture global 3D contextual information limit their practical applications. To address these challenges, we propose a novel text-guided diffusion model framework, TextDiffSeg. This method leverages a conditional diffusion framework that integrates 3D volumetric data with natural language descriptions, enabling cross-modal embedding and establishing a shared semantic space between visual and textual modalities. By enhancing the model's ability to recognize complex anatomical structures, TextDiffSeg incorporates innovative label embedding techniques and cross-modal attention mechanisms, effectively reducing computational complexity while preserving global 3D contextual integrity. Experimental results demonstrate that TextDiffSeg consistently outperforms existing methods in segmentation tasks involving kidney and pancreas tumors, as well as multi-organ segmentation scenarios. Ablation studies further validate the effectiveness of key components, highlighting the synergistic interaction between text fusion, image feature extractor, and label encoder. TextDiffSeg provides an efficient and accurate solution for 3D medical image segmentation, showcasing its broad applicability in clinical diagnosis and treatment planning.

📄 PDF Abstract BibTeX arXiv:2504.11825

Code (0)

등록된 구현이 없습니다.

Tasks

Image SegmentationLatent Diffusion Model for 3DMedical Image SegmentationOrgan SegmentationSegmentationSemantic Segmentation

Methods 이 논문이 사용한 방법론

Softmax The Softmax output function transforms a previous layer's output into a vector of probabilities. It is commonly used for multiclass classification. Given an input vector $x$…
Attention 설명 없음
Diffusion Diffusion models generate samples by gradually removing noise from a signal, and their training objective can be expressed as a reweighted variational lower-bound…

Similar Papers 제목 키워드 기반

Language-Guided Trajectory Traversal in Disentangled Stable Diffusion Latent Space for Factorized Medical Image Generation

2025-03-30 · Zahra Tehraninasab, Amar Kumar, Tal Arbel

Text-to-image diffusion models have demonstrated a remarkable ability to generate photorealistic images from natural language prompts. These high-resolution, language-guided synthesized images are essential for the expla…

DiagnosticDisentanglementImage GenerationMedical Image Generation

Latent Space Synergy: Text-Guided Data Augmentation for Direct Diffusion Biomedical Segmentation

2025-07-21 · Muhammad Aqeel, Maham Nazir, Zanxi Ruan, Francesco Setti arxiv

Medical image segmentation suffers from data scarcity, particularly in polyp detection where annotation requires specialized expertise. We present SynDiff, a framework combining text-guided synthetic data generation with…

Medical Image SegmentationSynthetic Data GenerationData Augmentation

MediSyn: Text-Guided Diffusion Models for Broad Medical 2D and 3D Image Synthesis

2024-05-16 · Joseph Cho, Cyril Zakka, Dhamanpreet Kaur, Rohan Shad 외

Diffusion models have recently gained significant traction due to their ability to generate high-fidelity and diverse images and videos conditioned on text prompts. In medicine, this application promises to address the c…

Image Generation

Diffusion-Based Data Augmentation for Medical Image Segmentation

2025-08-25 · Maham Nazir, Muhammad Aqeel, Francesco Setti arxiv

Medical image segmentation models struggle with rare abnormalities due to scarce annotated pathological data. We propose DiffAug a novel framework that combines textguided diffusion-based generation with automatic segmen…

Medical Image SegmentationData Augmentation

Enhancing Label-efficient Medical Image Segmentation with Text-guided Diffusion Models

2024-07-07 · Chun-Mei Feng

Aside from offering state-of-the-art performance in medical image generation, denoising diffusion probabilistic models (DPM) can also serve as a representation learner to capture semantic information and potentially be u…

DenoisingDiagnosticImage GenerationImage Segmentation+4