@article{geometryentangledvisualsemantic, title = {Geometry-Entangled Visual Semantic Transformer for Image Captioning}, author = {Ling Cheng and Wei Wei and Feida Zhu and Yong liu and Chunyan Miao}, year = {2021}, eprint = {2109.14137}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2109.14137v1}, }