@article{towardeffectivereinforcementlearningfine, title = {Toward Effective Reinforcement Learning Fine-Tuning for Medical VQA in Vision-Language Models}, author = {Wenhui Zhu and Xuanzhao Dong and Xin Li and Peijie Qiu and Xiwen Chen and Abolfazl Razi and Aris Sotiras and Yi Su and Yalin Wang}, year = {2025}, eprint = {2505.13973}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2505.13973v1}, }