Views
No views yet
action_dim=14 — dense input to ActionEmbedder (no sparse 384-dim multi-embodiment padding)1e-4, AdaLN modulation 1.6e-4, Backbone 1.6e-7 (quasi-frozen)[-1, 1] via p01/p99 statistics over dk1-merge-2026-03model_ema_bf16.pt — EMA weights in bfloat16, no optimizer states.1from cosmos_predict2._src.predict2.utils.model_loader import load_model_from_checkpoint
2model, config = load_model_from_checkpoint(
3 experiment_name="dreamdojo_2b_480_640_dk1_merge",
4 s3_checkpoint_dir="model_ema_bf16.pt",
5 config_file="cosmos_predict2/_src/predict2/action/configs/action_conditioned/config.py",
6 load_ema_to_reg=True,
7)eval/ directory contains 32 comparison videos (random episodes from dk1-merge-2026-03):
GT | generated with GT actions | generated with zero actions