@article{rvlmregionawarevisionlanguagemodelforpre, title = {R-VLM: Region-Aware Vision Language Model for Precise GUI Grounding}, author = {Joonhyung Park and Peng Tang and Sagnik Das and Srikar Appalaraju and Kunwar Yashraj Singh and R. Manmatha and Shabnam Ghadar}, year = {2025}, eprint = {2507.05673}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2507.05673}, }