Views
No views yet
extra_state.pt preserves the CoLAR latent head for latent decoding.config.json, model*.safetensors, tokenizer files)extra_state.pt with the latent policy and embedding weights required for CoLAR latent decodingexport_meta.json from the local export steplatent_metadata.json with structured provenance and hyperparametersartifacts/source_wandb_config.yaml, artifacts/source_wandb_summary.json, and artifacts/source_wandb_metadata.jsonartifacts/source_all_config.json parsed from the original WandB all_config| Field | Value |
|---|---|
| WandB run | b7fyxsug |
| Run date | 2025-09-29 |
| Task | Narrative continuation planning |
| Stage | post-SFT |
| Base model | Qwen/Qwen2.5-7B-Instruct |
| Git commit | 3709e7a067a6c6e033942b768d6cc88ba54e82d0 |
| Host / GPU | alexgurung-latent-qcvnm-ctgn8 / NVIDIA H200 |
| Original checkpoint | /mnt/volume3/baseline_colar/colar/oldlogs/colar/colar-experiments/b7fyxsug/checkpoints/pt_epoch1__step451__monitor3.139.ckpt |
| Generalization slug | colar_ncp_post_sft |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3repo_dir = "agurung/colar-qwen25-7b-ncp-post-sft"
4model = AutoModelForCausalLM.from_pretrained(repo_dir, torch_dtype="auto", device_map="auto")
5tokenizer = AutoTokenizer.from_pretrained(repo_dir)1from huggingface_hub import snapshot_download
2from pathlib import Path
3
4local_dir = Path(snapshot_download("agurung/colar-qwen25-7b-ncp-post-sft"))
5llm_dir = local_dir
6extra_state = local_dir / "extra_state.pt"python -m litereason.experiments.latent_eval.colar.evaluate_colar --llm-dir "$LOCAL_DIR" --extra-state "$LOCAL_DIR/extra_state.pt" --test-file litereason/experiments/generalization/data/gsm8k.jsonl --prompt-variant standard --save-preds preds_gsm8k_standard.jsonl --num-samples 5 --use-chat-template| Field | Value |
|---|---|
| Trainer strategy | deepspeed_stage_2_offload |
| Max epochs | 2 |
| Precision | bf16-mixed |
| Global batch size | 1 |
| Validation batch size | 4 |
| Compression factor | 5 |
| Max latent forward | 64 |
| Latent temperature | 1.0 |
| Group size | 8 |
| Experience batch size | 64 |
| Train samples / epoch | 512 |
| Metric | Value |
|---|---|
monitor | 3.1386220455169678 |
val/loss | 3.1386220455169678 |
val/ce_loss | 2.084620952606201 |
val/embed_modeling_loss | 1.0540010929107666 |
epoch | 1 |
trainer/global_step | 450 |
/mnt/volume3/baseline_colar/colar/oldlogs/colar/wandb/run-20250929_200617-b7fyxsug/files/config.yaml/mnt/volume3/baseline_colar/colar/oldlogs/colar/wandb/run-20250929_200617-b7fyxsug/files/wandb-summary.json/mnt/volume3/baseline_colar/colar/oldlogs/colar/wandb/run-20250929_200617-b7fyxsug/files/wandb-metadata.json/mnt/disk/baseline_colar/colar/exported_hf/b7fyxsug