@article{improvingvisualspeechenhancementnetwork, title = {Improving Visual Speech Enhancement Network by Learning Audio-visual Affinity with Multi-head Attention}, author = {Xinmeng Xu and Yang Wang and Jie Jia and Binbin Chen and Dejun Li}, year = {2022}, eprint = {2206.14964}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2206.14964v1}, }