Papers Adroid door-cloned
“Adroid door-cloned” 태그가 달린 논문 1편 · 필터 해제
Uncertainty-Based Offline Reinforcement Learning with Diversified Q-Ensemble
2021-10-04 · NeurIPS 2021 12
· Gaon An, Seungyong Moon, Jang-Hyun Kim, Hyun Oh Song
Offline reinforcement learning (offline RL), which aims to find an optimal policy from a previously collected static dataset, bears algorithmic difficulties due to function approximation errors from out-of-distribution (…
Adroid door-clonedAdroid door-humanAdroid hammer-clonedAdroid hammer-human+17
1–1 / 1