Views
No views yet
This is a trained model of a PPO agent playing LunarLander-v2. ## Evaluation Results - Mean Reward: -56.14 ± 76.83 - Number of Evaluation Episodes: 10 ## Hyperparameters ```python {'env_id': 'LunarLander-v2'