@article{selfsupervisedandgeneralizable, title = {Self-Supervised and Generalizable Tokenization for CLIP-Based 3D Understanding}, author = {Guofeng Mei and Bin Ren and Juan Liu and Luigi Riz and Xiaoshui Huang and Xu Zheng and Yongshun Gong and Ming-Hsuan Yang and Nicu Sebe and Fabio Poiesi}, year = {2025}, eprint = {2505.18819}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2505.18819v1}, }