@article{viclevravisualreasoningdatasetandhybrid, title = {ViCLEVR: A Visual Reasoning Dataset and Hybrid Multimodal Fusion Model for Visual Question Answering in Vietnamese}, author = {Khiem Vinh Tran and Hao Phu Phan and Kiet Van Nguyen and Ngan Luu Thuy Nguyen}, year = {2023}, eprint = {2310.18046}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2310.18046v1}, }