@article{visurfvisualsupervisedandreinforcementfi, title = {ViSurf: Visual Supervised-and-Reinforcement Fine-Tuning for Large Vision-and-Language Models}, author = {Yuqi Liu and Liangyu Chen and Jiazhen Liu and Mingkang Zhu and Zhisheng Zhong and Bei Yu and Jiaya Jia}, year = {2025}, eprint = {2510.10606}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2510.10606}, }