Views
No views yet
mlagents-learn ./config/ppo/SnowballTarget.yaml --run-id="SnowballTarget-v1" --resume1behaviors:
2SnowballTarget:
3 trainer_type: ppo
4 summary_freq: 10000
5 keep_checkpoints: 5
6 checkpoint_interval: 50000
7 max_steps: 900000
8 time_horizon: 128
9 threaded: true
10 hyperparameters:
11 learning_rate: 0.0001
12 learning_rate_schedule: linear
13 batch_size: 128
14 buffer_size: 4096
15 beta: 0.005
16 epsilon: 0.2
17 lambd: 0.95
18 num_epoch: 5
19 network_settings:
20 normalize: false
21 hidden_units: 256
22 num_layers: 3
23 vis_encode_type: simple
24 reward_signals:
25 extrinsic:
26 gamma: 0.99
27 strength: 1.0