Views
No views yet
weights/pi05_base/params (pi0.5 base weights).mixed — human demos are trained with prompt "pack coffee capsules into the cardboard bin container. Advantage: positive", policy-collected frames with "... Advantage: negative".pi05_bin_pack_coffee_capsules_reward_recap_mixed_from_basepi05=True, action_horizon=50)villekuosmanen/bin_pick_pack_coffee_capsulesvillekuosmanen/dAgger_bin_pick_pack_coffee_capsules_1.0.0villekuosmanen/dAgger_bin_pick_pack_coffee_capsules_1.1.0villekuosmanen/dAgger_bin_pick_pack_coffee_capsules_1.2.0villekuosmanen/dAgger_bin_pick_pack_coffee_capsules_1.3.1villekuosmanen/dAgger_bin_pick_pack_coffee_capsules_1.4.0villekuosmanen/dAgger_bin_pick_pack_coffee_capsules_1.5.0villekuosmanen/dAgger_bin_pick_pack_coffee_capsules_1.5.1villekuosmanen/dAgger_bin_pick_pack_coffee_capsules_1.7.0| Step | Loss |
|---|---|
| 0 | 0.3473 |
| 25,000 | 0.0125 |
| 50,000 | ~0.0075 |
| 74,000 | ~0.0070 |
find params -type f | sort | xargs cat | sha256sum.| Step | Loss | SHA-256 |
|---|---|---|
| 25,000 | 0.0125 | 9e6d903b70a0159d6fb9979570556b031650f2e733e9b8a30c1d17b08f3307c2 |
| 50,000 | ~0.0075 | f347d098e046f63ef65aa9c0c7a5614e0735667f1d03a5f8fb893e43698079c9 |
| 74,000 | ~0.0070 | 4fd1de8b341df95595b7691443e524638c80a0f1eb58c09d717a33741482d70e |
assets/ # Norm stats for inference
checkpoints/<step>/params/ # Model weights (params only)
README.md # This file
TRAINING_LOG.md # Training log1from openpi.training.config import get_config
2from openpi.serving.policy_server import PolicyServer
3
4config = get_config("pi05_bin_pack_coffee_capsules_reward_recap_mixed_from_base")
5server = PolicyServer(config, checkpoint_path="checkpoints/<step>/params")