@article{visualgroundingwithmultimodalconditional, title = {Visual Grounding with Multi-modal Conditional Adaptation}, author = {Ruilin Yao and Shengwu Xiong and Yichen Zhao and Yi Rong}, year = {2024}, eprint = {2409.04999}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2409.04999v1}, }