← Flash PapersRainbow: Combining Improvements in Deep Reinforcement Learning

Share this Flash Paper

Rainbow: Combining Improvements in Deep Reinforcement Learning

https://flashpapers.ai/p/uqem6eum2b
Make your own
Matteo Hessel, Joseph Modayil +8 more
Details ▸
Median human-normalized score (no-ops):223%· Atari 57Median human-normalized score (human starts):153%· Atari 57Frames to match DQN best performance:7M· Atari 57Frames to surpass all baselines:44M· Atari 57