paper-with-me

Atari Games 벤치마크

Atari Games on Atari 2600 Space Invaders

110개 결과 · ⬇ CSV · JSON

Score

160.8 3.872e+04 7.727e+04 1.158e+05 1.544e+05 2012-07 2026-09 UCT — 2718.0 (2012-07-19) Best Learner — 250.1 (2012-07-19) UCT — 2718.0 (2012-07-19) Best Learner — 250.1 (2012-07-19) DQN Best — 1075.0 (2013-12-19) DQN Best — 1075.0 (2013-12-19) Nature DQN — 1976.0 (2015-02-25) Nature DQN — 1976.0 (2015-02-25) Gorila — 1183.3 (2015-07-15) Gorila — 1183.3 (2015-07-15) Prior+Duel hs — 8978.0 (2015-09-22) DDQN (tuned) hs — 2628.7 (2015-09-22) DQN noop — 1692.3 (2015-09-22) DQN hs — 1293.8 (2015-09-22) Prior+Duel hs — 8978.0 (2015-09-22) DDQN (tuned) hs — 2628.7 (2015-09-22) DQN noop — 1692.3 (2015-09-22) DQN hs — 1293.8 (2015-09-22) Prior hs — 3912.1 (2015-11-18) Prior noop — 2865.8 (2015-11-18) Prior hs — 3912.1 (2015-11-18) Prior noop — 2865.8 (2015-11-18) Prior+Duel noop — 15311.5 (2015-11-20) Duel noop — 6427.3 (2015-11-20) Duel hs — 5993.1 (2015-11-20) DDQN (tuned) noop — 2525.5 (2015-11-20) Prior+Duel noop — 15311.5 (2015-11-20) Duel noop — 6427.3 (2015-11-20) Duel hs — 5993.1 (2015-11-20) DDQN (tuned) noop — 2525.5 (2015-11-20) DARQN soft — 650.0 (2015-12-05) DARQN soft — 650.0 (2015-12-05) Advantage Learning — 3460.79 (2015-12-15) Persistent AL — 3277.59 (2015-12-15) Advantage Learning — 3460.79 (2015-12-15) Persistent AL — 3277.59 (2015-12-15) A3C LSTM hs — 23846.0 (2016-02-04) A3C FF hs — 15730.5 (2016-02-04) A3C FF (1 day) hs — 2214.7 (2016-02-04) A3C LSTM hs — 23846.0 (2016-02-04) A3C FF hs — 15730.5 (2016-02-04) A3C FF (1 day) hs — 2214.7 (2016-02-04) Bootstrapped DQN — 2893.0 (2016-02-15) Bootstrapped DQN — 2893.0 (2016-02-15) DDQN+Pop-Art noop — 2589.7 (2016-02-24) DDQN+Pop-Art noop — 2589.7 (2016-02-24) ES FF (1 hour) noop — 678.5 (2017-03-10) ES FF (1 hour) noop — 678.5 (2017-03-10) NoisyNet-Dueling — 5909.0 (2017-06-30) NoisyNet-Dueling — 5909.0 (2017-06-30) C51 noop — 5747.0 (2017-07-21) C51 noop — 5747.0 (2017-07-21) MAC — 1173.1 (2017-09-01) MAC — 1173.1 (2017-09-01) Rainbow — 12629.0 (2017-10-06) Rainbow — 12629.0 (2017-10-06) QR-DQN-1 — 20972.0 (2017-10-27) QR-DQN-1 — 20972.0 (2017-10-27) DDRL A3C — 650.0 (2018-01-09) DDRL A3C — 650.0 (2018-01-09) IMPALA (deep) — 43595.78 (2018-02-05) IMPALA (deep) — 43595.78 (2018-02-05) Ape-X — 54681.0 (2018-03-02) Ape-X — 54681.0 (2018-03-02) IDVQ + DRSC + XNES — 830.0 (2018-06-04) IDVQ + DRSC + XNES — 830.0 (2018-06-04) IQN — 28888.0 (2018-06-14) A2C + SIL — 2951.7 (2018-06-14) CGP — 1001.0 (2018-06-14) IQN — 28888.0 (2018-06-14) A2C + SIL — 2951.7 (2018-06-14) CGP — 1001.0 (2018-06-14) POP3D — 1216.15 (2018-07-02) POP3D — 1216.15 (2018-07-02) R2D2 — 43223.4 (2019-05-01) R2D2 — 43223.4 (2019-05-01) SAC — 160.8 (2019-10-16) SAC — 160.8 (2019-10-16) FQF — 46498.3 (2019-11-05) FQF — 46498.3 (2019-11-05) MuZero — 74335.3 (2019-11-19) MuZero — 74335.3 (2019-11-19) Agent57 — 48680.86 (2020-03-30) Agent57 — 48680.86 (2020-03-30) MFEC — 1990.0 (2020-08-21) MFEC — 1990.0 (2020-08-21) DreamerV2 — 2474.0 (2020-10-05) DreamerV2 — 2474.0 (2020-10-05) Recurrent Rational DQN Average — 1395.0 (2021-02-18) Rational DQN Average — 650.0 (2021-02-18) Recurrent Rational DQN Average — 1395.0 (2021-02-18) Rational DQN Average — 650.0 (2021-02-18) MuZero (Res2 Adam) — 3645.63 (2021-04-13) MuZero (Res2 Adam) — 3645.63 (2021-04-13) GDI-I3 — 140460.0 (2021-06-11) GDI-I3 — 140460.0 (2021-06-11) GDI-H3(200M frames) — 154380.0 (2022-06-07) GDI-H3 — 154380.0 (2022-06-07) GDI-I3 — 140460.0 (2022-06-07) GDI-H3(200M frames) — 154380.0 (2022-06-07) GDI-H3 — 154380.0 (2022-06-07) GDI-I3 — 140460.0 (2022-06-07) DNA — 2731.0 (2022-06-20) DNA — 2731.0 (2022-06-20) ASL DDQN — 21602.0 (2023-05-07) ASL DDQN — 21602.0 (2023-05-07) UCT — 2718.0 (2012-07-19) Prior+Duel hs — 8978.0 (2015-09-22) Prior+Duel noop — 15311.5 (2015-11-20) A3C LSTM hs — 23846.0 (2016-02-04) IMPALA (deep) — 43595.78 (2018-02-05) Ape-X — 54681.0 (2018-03-02) MuZero — 74335.3 (2019-11-19) GDI-I3 — 140460.0 (2021-06-11) GDI-H3(200M frames) — 154380.0 (2022-06-07)
RankModel ScoreBest ScoreReturn PaperCodeYear
101 CGP 1001 Evolving simple programs for playing Atari games ShuhuaGao/gpFlappyBird · JacobLaney/cgp-tetris 2018
102 IDVQ + DRSC + XNES 830 Playing Atari with Six Neurons giuse/DNE 2018
103 ES FF (1 hour) noop 678.5 Evolution Strategies as a Scalable Alternative to Reinforcement Learning ray-project/ray · openai/evolution-strategies-starter · atgambardella/pytorch-es · +20 2017
104 DDRL A3C 650 Distributed Deep Reinforcement Learning: Learn how to play Atari games in 21 minutes deepsense-ai/Distributed-BA3C 2018
104 DARQN soft 650 Deep Attention Recurrent Q-Network 5vision/DARQN · ulstu/robotics_ml · ulstu/ml 2015
104 Rational DQN Average 650 Adaptive Rational Activations to Boost Deep Reinforcement Learning ml-research/rational_activations · ml-research/rational_rl · k4ntz/activation-functions · +1 2021
107 SARSA 267.9
108 Best Learner 250.1 The Arcade Learning Environment: An Evaluation Platform for General Agents mgbellemare/Arcade-Learning-Environment · kenjyoung/MinAtar · nandomp/AICollaboratory 2012
109 SAC 160.8 Soft Actor-Critic for Discrete Action Settings p-christ/Deep-Reinforcement-Learning-Algorithms-with-PyTorch · ku2482/sac-discrete.pytorch · keraJLi/rejax · +10 2019
110 IQ-Learn 507 IQ-Learn: Inverse soft-Q Learning for Imitation Div99/IQ-Learn · robfiras/ls-iq · google-deepmind/csil · +2 2021
← 이전 101–110 / 110 페이지당 10 20 50 100