@article{enhancingvisualquestionansweringthrough1, title = {Enhancing Visual Question Answering through Ranking-Based Hybrid Training and Multimodal Fusion}, author = {Peiyuan Chen and Zecheng Zhang and Yiping Dong and Li Zhou and Han Wang}, year = {2024}, eprint = {2408.07303}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2408.07303v2}, }