← Flash PapersSoft Actor-Critic: Maximum Entropy Deep Reinforcement Learning

Share this Flash Paper

Soft Actor-Critic: Maximum Entropy Deep Reinforcement Learning

https://flashpapers.ai/p/6xmqa63u27
Make your own
Tuomas Haarnoja, Aurick Zhou +2 more
Details ▸
Average Return:15000· HalfCheetah-v1Average Return:6000· Ant-v1Average Return:6000· Humanoid (rllab)