@article{prototypeawaremultimodalalignmentforopen, title = {Prototype-Aware Multimodal Alignment for Open-Vocabulary Visual Grounding}, author = {Jiangnan Xie and Xiaolong Zheng and Liang Zheng}, year = {2025}, eprint = {2509.06291}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2509.06291}, }