Views
No views yet
1model = PPO( 2 policy="MlpPolicy", 3 env=env, 4 n_steps=2048, 5 batch_size=64, 6 n_epochs=6, 7 gamma=0.999, 8 gae_lambda=0.98, 9 ent_coef=0.01, 10 verbose=1, 11) 12total_timesteps=750000 13...