@article{amultimodalvisualencodingmodelaidedby, title = {A Multimodal Visual Encoding Model Aided by Introducing Verbal Semantic Information}, author = {Shuxiao Ma and Linyuan Wang and Bin Yan}, year = {2023}, eprint = {2308.15142}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2308.15142v1}, }