@article{overtonpluralisticreinforcementlearningf, title = {Overton Pluralistic Reinforcement Learning for Large Language Models}, author = {Yu Fu and Seongho Son and Ilija Bogunovic}, year = {2026}, eprint = {2602.20759}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2602.20759}, }