@article{serasampleefficientrewardaugmentationin, title = {Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration}, author = {Ziqi Zhang and Xiao Xiong and Zifeng Zhuang and Jinxin Liu and Donglin Wang}, year = {2023}, eprint = {2310.19805}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2310.19805v4}, }