@article{partwholerelationalfusiontowardsmulti, title = {Part-Whole Relational Fusion Towards Multi-Modal Scene Understanding}, author = {Yi Liu and Chengxin Li and Shoukun Xu and Jungong Han}, year = {2024}, eprint = {2410.14944}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2410.14944v1}, }