@article{improvingcrossmodalalignmentwith, title = {Improving Cross-modal Alignment with Synthetic Pairs for Text-only Image Captioning}, author = {Zhiyue Liu and JinYuan Liu and Fanrong Ma}, year = {2023}, eprint = {2312.08865}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2312.08865v1}, }