@article{unitokenharmonizingmultimodalunderstandi, title = {UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding}, author = {Yang Jiao and Haibo Qiu and Zequn Jie and Shaoxiang Chen and Jingjing Chen and Lin Ma and Yu-Gang Jiang}, year = {2025}, eprint = {2504.04423}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2504.04423v1}, }