@article{styletalkerfinetuningaudiolanguagemodel, title = {Style-Talker: Finetuning Audio Language Model and Style-Based Text-to-Speech Model for Fast Spoken Dialogue Generation}, author = {Yinghao Aaron Li and Xilin Jiang and Jordan Darefsky and Ge Zhu and Nima Mesgarani}, year = {2024}, eprint = {2408.11849}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2408.11849v1}, }