paper-with-me

Papers Adroid hammer-cloned

“Adroid hammer-cloned” 태그가 달린 논문 1편 · 필터 해제

Uncertainty-Based Offline Reinforcement Learning with Diversified Q-Ensemble

2021-10-04 · NeurIPS 2021 12 · Gaon An, Seungyong Moon, Jang-Hyun Kim, Hyun Oh Song

Offline reinforcement learning (offline RL), which aims to find an optimal policy from a previously collected static dataset, bears algorithmic difficulties due to function approximation errors from out-of-distribution (…

Adroid door-clonedAdroid door-humanAdroid hammer-clonedAdroid hammer-human+17
1–1 / 1