@article{ditardiffusiontransformerautoregressive, title = {DiTAR: Diffusion Transformer Autoregressive Modeling for Speech Generation}, author = {Dongya Jia and Zhuo Chen and Jiawei Chen and Chenpeng Du and Jian Wu and Jian Cong and Xiaobin Zhuang and ChuMin Li and Zhen Wei and Yuping Wang and Yuxuan Wang}, year = {2025}, eprint = {2502.03930}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2502.03930v3}, }