@article{multilingualvisualspeechrecognitionwitha, title = {Efficient Training for Multilingual Visual Speech Recognition: Pre-training with Discretized Visual Speech Representation}, author = {Minsu Kim and Jeong Hun Yeo and Se Jin Park and Hyeongseop Rha and Yong Man Ro}, year = {2024}, eprint = {2401.09802}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2401.09802v2}, }