Views
No views yet
1import gymnasium as gym
2from stable_baselines3 import PPO
3from stable_baselines3.common.env_util import make_vec_env
4
5env = make_vec_env("LunarLander-v3", n_envs=8)
6
7model = PPO(
8 policy="MlpPolicy",
9 env=env,
10 n_steps=1024,
11 batch_size=64,
12 n_epochs=4,
13 gamma=0.999,
14 gae_lambda=0.98,
15 ent_coef=0.01,
16 verbose=1,
17)
18
19model.learn(total_timesteps=1_000_000)
20model.save("ppo-lunarlander-v3-full")
21
22print("Entraînement terminé et modèle sauvegardé !")
23