@inproceedings{mimoamedicalvisionlanguagemodelwith, title = {MIMO: A Medical Vision Language Model with Visual Referring Multimodal Input and Pixel Grounding Multimodal Output}, author = {Yanyuan Chen and Dexuan Xu and Yu Huang and Songkun Zhan and Hanpin Wang and Dongxue Chen and Xueping Wang and Meikang Qiu and Hang Li}, year = {2025}, booktitle = {CVPR 2025 1}, url = {http://openaccess.thecvf.com//content/CVPR2025/html/Chen_MIMO_A_Medical_Vision_Language_Model_with_Visual_Referring_Multimodal_CVPR_2025_paper.html}, }