@article{augmentingvisionlanguagepretrainingby, title = {Augmenting Vision Language Pretraining by Learning Codebook with Visual Semantics}, author = {Xiaoyuan Guo and Jiali Duan and C. -C. Jay Kuo and Judy Wawira Gichoya and Imon Banerjee}, year = {2022}, eprint = {2208.00475}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2208.00475v1}, }