@article{stsaspatialtemporalsemanticalignmentfor, title = {STSA: Spatial-Temporal Semantic Alignment for Visual Dubbing}, author = {Zijun Ding and Mingdie Xiong and Congcong Zhu and Jingrun Chen}, year = {2025}, eprint = {2503.23039}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2503.23039v1}, }