@article{llavagroundinggroundedvisualchatwith, title = {LLaVA-Grounding: Grounded Visual Chat with Large Multimodal Models}, author = {Hao Zhang and Hongyang Li and Feng Li and Tianhe Ren and Xueyan Zou and Shilong Liu and Shijia Huang and Jianfeng Gao and Lei Zhang and Chunyuan Li and Jianwei Yang}, year = {2023}, eprint = {2312.02949}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2312.02949v1}, }