@article{talkert2avjointtalkingaudiovideogenerati, title = {Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling}, author = {Zhen Ye and Xu Tan and Aoxiong Yin and Hongzhan Lin and Guangyan Zhang and Peiwen Sun and Yiming Li and Chi-Min Chan and Wei Ye and Shikun Zhang and Wei Xue}, year = {2026}, eprint = {2604.23586}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2604.23586}, }