@article{provablyefficientreinforcementlearningvi, title = {Provably Efficient Reinforcement Learning via Surprise Bound}, author = {Hanlin Zhu and Ruosong Wang and Jason D. Lee}, year = {2023}, eprint = {2302.11634}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2302.11634v1}, }