@article{canreinforcementlearningfindstackelberg, title = {Can Reinforcement Learning Find Stackelberg-Nash Equilibria in General-Sum Markov Games with Myopic Followers?}, author = {Han Zhong and Zhuoran Yang and Zhaoran Wang and Michael I. Jordan}, year = {2021}, eprint = {2112.13521}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2112.13521v1}, }