Views
No views yet
weights/pi05_base/params (pi0.5 base weights).positive_only — human demos are trained with prompt "build a block tower. Advantage: positive", policy-collected frames are dropped.pi05_build_block_tower_dynapi05=True, action_horizon=50)villekuosmanen/build_block_towervillekuosmanen/dAgger_build_block_tower_1.0.0villekuosmanen/dAgger_build_block_tower_1.1.0villekuosmanen/dAgger_build_block_tower_1.2.0villekuosmanen/dAgger_build_block_tower_1.3.0villekuosmanen/dAgger_build_block_tower_1.4.0tar cf - -C checkpoints/<step> params | sha256sum.| Step | Loss | SHA-256 |
|---|---|---|
| 25,000 | 0.0212 | 9bb8e728529b7d4461467b45ec1c7b9fed972ab03bf74feec85e1021047f0545 |
| 50,000 | 0.0145 | a6673bee89023ba6726fa5c2c7d9957c289b8cdd5427be0815720a31eb3f0164 |
| 80,000 | ~0.0115 | 564caf6cfdfe57d80733e8806f28005d6077189d7dfdcb8f2b4f5e6857dab827 |
48,000 was removed from the HuggingFace repo._step=81600 (final local logs reached step 81,900 before manual stop).assets/ # Norm stats for inference
checkpoints/<step>/params/ # Model weights (params only)
README.md # This file
TRAINING_LOG.md # Training log1from openpi.training.config import get_config
2from openpi.serving.policy_server import PolicyServer
3
4config = get_config("pi05_build_block_tower_dyna")
5server = PolicyServer(config, checkpoint_path="checkpoints/<step>/params")