| library_name: cleanrl | |
| tags: | |
| - LunarLander-v2 | |
| - LunarLander-v3 | |
| - deep-reinforcement-learning | |
| - reinforcement-learning | |
| - ppo | |
| model-index: | |
| - name: PPO | |
| results: | |
| - task: | |
| type: reinforcement-learning | |
| name: reinforcement-learning | |
| dataset: | |
| name: LunarLander-v2 | |
| type: LunarLander-v2 | |
| metrics: | |
| - type: mean_reward | |
| value: 235.61 +/- 50.00 | |
| name: mean_reward | |
| verified: false | |
| # **PPO** Agent playing **LunarLander-v3** (CleanRL) | |
| This is a trained model of a CleanRL PPO agent playing LunarLander-v3 for Unit 8. | |