Views
No views yet
1 policy = 'MlpPolicy', 2 env = env, 3 n_steps = 1024, 4 batch_size = 32, 5 n_epochs = 4, 6 gamma = 0.9990, 7 gae_lambda = 0.995, 8 ent_coef = 0.005, 9 verbose=1) 10 11 model.learn(total_timesteps=2000000)```