Views
No views yet
weights/pi05_base/params (pi0.5 base weights).mixed — human demos are trained with prompt "build a block tower. Advantage: positive", policy-collected frames with "... Advantage: negative".pi05_build_block_tower_mixedpi05=True, action_horizon=50)villekuosmanen/build_block_towervillekuosmanen/dAgger_build_block_tower_1.0.0villekuosmanen/dAgger_build_block_tower_1.1.0villekuosmanen/dAgger_build_block_tower_1.2.0villekuosmanen/dAgger_build_block_tower_1.3.0villekuosmanen/dAgger_build_block_tower_1.4.0cd checkpoints/<step> && find params -type f | sort | xargs sha256sum | sha256sum| Step | Loss | SHA-256 |
|---|---|---|
| 25,000 | 0.0207 | 6d44e6b2aec69b964e974ffcf551834ac443196a36d85e891d9f246859a1afb1 |
| 30,000 | 0.0179 | d9544183f5a70f044f044c103c551c57588aaeaf3ff1b46b4159cd10fef6f528 |
| 50,000 | 0.0144 | 3f289b60f8f4d9676ff3250aae41919355045d72b92cd7d4e0a21ea9071dea91 |
| 75,000 | 0.0112 | 4a2b9d394f89bdb4ba2e3620eb774bba5ba9a8c829e85e2319d1dd1adb2bd03d |
assets/ # Norm stats for inference
checkpoints/<step>/params/ # Model weights (params only)
README.md # This file
TRAINING_LOG.md # Training log1from openpi.training.config import get_config
2from openpi.serving.policy_server import PolicyServer
3
4config = get_config("pi05_build_block_tower_mixed")
5server = PolicyServer(config, checkpoint_path="checkpoints/<step>/params")