Views
No views yet
| File | Description |
|---|---|
phase1_rl_token.pt | Phase 1: RL token encoder pretrained on XVLA (lerobot/xvla-base) embeddings extracted from 100 synthetic demo episodes. Loss: 0.65 → 0.024 over 50 epochs. |
phase2_offline.pt | Phase 2: Actor + Critic trained offline via TD3+BC on 13,100 demo transitions with synthetic distance-to-goal rewards. 5,100 gradient steps. |
generate_synthetic_data.py)1pixi run ros2 run aic_model aic_model \
2 --ros-args \
3 -p use_sim_time:=true \
4 -p policy:=aic_example_policies.ros.RunRLT \
5 -p policy_args.checkpoint_path:=$(hf_hub_download siyulw2025/aic-rlt-cable-insertion phase2_offline.pt)aic_example_policies/ros/RunRLT.py for the full inference policy.