@article{transvgendtoendvisualgroundingwith1, title = {TransVG++: End-to-End Visual Grounding with Language Conditioned Vision Transformer}, author = {Jiajun Deng and Zhengyuan Yang and Daqing Liu and Tianlang Chen and Wengang Zhou and Yanyong Zhang and Houqiang Li and Wanli Ouyang}, year = {2022}, eprint = {2206.06619}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2206.06619v1}, }