@article{toocorrecttolearnreinforcementlearningon, title = {Too Correct to Learn: Reinforcement Learning on Saturated Reasoning Data}, author = {Zhenwen Liang and Yujun Zhou and Sidi Lu and Xiangliang Zhang and Haitao Mi and Dong Yu}, year = {2026}, eprint = {2604.18493}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2604.18493}, }