Views
No views yet
1ppo_full_finetune_single_device.py \
2 --config ./target/7B_full_ppo_low_memory_single_device.yaml \
3 device=cuda \
4 metric_logger._component_=torchtune.utils.metric_logging.WandBLogger \
5 metric_logger.project=torchtune_ppo \
6 forward_batch_size=2 \
7 batch_size=64 \
8 ppo_batch_size=32 \
9 gradient_accumulation_steps=16 \
10 compile=True \
11 optimizer._component_=bitsandbytes.optim.PagedAdamW \
12 optimizer.lr=3e-4