@article{serposelfevolvingrubricpolicyoptimizatio, title = {SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning}, author = {Jianze Wang and Kunwang Zheng and Ying Liu and Yu Cao and Qilong Zhang and Jinlong Chen and Hua Yang and Qianglong Chen}, year = {2026}, eprint = {2607.26873}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2607.26873}, }