@article{240800624, title = {SynesLM: A Unified Approach for Audio-visual Speech Recognition and Translation via Language Model and Synthetic Data}, author = {Yichen Lu and Jiaqi Song and Xuankai Chang and Hengwei Bian and Soumi Maiti and Shinji Watanabe}, year = {2024}, eprint = {2408.00624}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2408.00624v1}, }