Views
No views yet
| 実行系 | 1チャンク(50手)生成 | ピークメモリ |
|---|---|---|
| 本移植(MLX・bf16) | 522ms | 8.0GB |
| PyTorch MPS(参照実装) | 660ms | |
| PyTorch CPU(参照実装) | 2,395ms |
hf auth loginしてから実行してください。1pip install mlx-vlm pillow transformers
2hf download tokimoa/pi0-mlx --local-dir pi0-mlx1from pi0_mlx import Pi0MLX
2
3model = Pi0MLX.from_pretrained("pi0-mlx")
4actions = model.predict(
5 images=[cam0, cam1, cam2], # HWC uint8(1〜3カメラ)
6 instruction="pick up the cube",
7 state=[0.1, -0.2, 0.3, 0.0, 0.5, 0.0],
8) # -> (50, len(state)) アクションチャンク1python pi0-mlx/pi0_mlx.py --images cam0.png cam1.png cam2.png \
2 --instruction "pick up the cube" --state 0,0,0,0,0,0model.safetensorsを差し替えれば動きます。前処理(224pxアスペクト維持リサイズ・言語トークナイズ・状態パディング)はランタイムに内蔵しています。