1from trainer import Trainer
2trainer = Trainer.from_pretrained('ahalev/mcuu-table-2-0f8ud8aq')
3algo, env = trainer.algo, trainer.env
4
5# Get an action from a random observation
6action, _ = algo.policy.get_action(env.observation_space.sample())
7
8# Evaluate the policy over 2920 timesteps
9evaluation = trainer.evaluate()