@inproceedings{provablyefficientreinforcementlearning2, title = {Reinforcement Learning with General Value Function Approximation: Provably Efficient Approach via Bounded Eluder Dimension}, author = {Ruosong Wang and Ruslan Salakhutdinov and Lin F. Yang}, year = {2020}, booktitle = {NeurIPS 2020 12}, eprint = {2005.10804}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2005.10804v3}, }