@article{constrainedpolicygradientmethodforsafe, title = {Constrained Policy Gradient Method for Safe and Fast Reinforcement Learning: a Neural Tangent Kernel Based Approach}, author = {Balázs Varga and Balázs Kulcsár and Morteza Haghir Chehreghani}, year = {2021}, eprint = {2107.09139}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2107.09139v2}, }