Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Learnix-AI-Lab
/
cleanrl-LunarLander-v2
Like
0
Reinforcement Learning
cleanrl
LunarLander-v2
ppo
deep-rl-course
unit-8
Eval Results (legacy)
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
CleanRL PPO Agent playing LunarLander-v2
CleanRL PPO Agent playing LunarLander-v2
This is a trained PPO agent playing LunarLander-v2 using CleanRL for Unit 8 Part 1.
Mean Reward
: 240.5 +/- 15.2
Result (mean - std)
: 225.30
Downloads last month
19
Video Preview
Reinforcement Learning
loading
Evaluation results
mean_reward
on LunarLander-v2
self-reported
240.5 +/- 15.2