X-ray Visual Question Answering
1개 벤치마크 · 논문 4편 · 이 태스크의 논문 보기 →
Benchmarks
MIMIC-CXR, MIMIC-IV
Most implemented
MedPromptX: Grounded Multimodal Prompting for Chest X-ray Diagnosis
Papers
Teach-to-Reason: Competition-Guided Reasoning with a Self-Improving Teacher
Chest X-ray visual question answering (CXR VQA) requires models not only to predict correct answers, but also to produce reliable medical reasoning. However, existing reinforcement-learning-based training typically relie…
X-ray Visual Question AnsweringEvaluating Reasoning Faithfulness in Medical Vision-Language Models using Multimodal Perturbations
Vision-language models (VLMs) often produce chain-of-thought (CoT) explanations that sound plausible yet fail to reflect the underlying decision process, undermining trust in high-stakes clinical use. Existing evaluation…
X-ray Visual Question AnsweringGrounding Chest X-Ray Visual Question Answering with Generated Radiology Reports
We present a novel approach to Chest X-ray (CXR) Visual Question Answering (VQA), addressing both single-image image-difference questions. Single-image questions focus on abnormalities within a specific CXR ("What abnorm…
Answer GenerationQuestion AnsweringVisual Question AnsweringVisual Question Answering (VQA)+1MedPromptX: Grounded Multimodal Prompting for Chest X-ray Diagnosis
Chest X-ray images are commonly used for predicting acute and chronic cardiopulmonary conditions, but efforts to integrate them with structured clinical data face challenges due to incomplete electronic health records (E…
Medical DiagnosisMedical Visual Question AnsweringVisual GroundingVisual Question Answering+2