@article{critiquerltraininglanguagemodelsforcriti, title = {Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning}, author = {Zhiheng Xi and Jixuan Huang and Xin Guo and Boyang Hong and Dingwen Yang and Xiaoran Fan and Shuo Li and Zehui Chen and Junjie Ye and Siyu Yuan and Zhengyin Du and Xuesong Yao and Yufei Xu and Jiecao Chen and Rui Zheng and Tao Gui and Qi Zhang and Xuanjing Huang}, year = {2025}, eprint = {2510.24320}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2510.24320}, }