Views
No views yet
zai-org/GLM-4.7-Flash,
trained with executable C++ correctness and performance rewards.| Setting | Value |
|---|---|
| Accelerators | 8x NVIDIA H100 |
| Parallelism | TP4 / PP1 / EP8 |
| Sequence length | 4,096 |
| Rollout batch | 32 prompts x 8 samples |
| Global batch size | 256 |
| LoRA rank / alpha | 16 / 32 |
| Peak allocated memory | 75,957 MiB per GPU |
| Wall time | 653 seconds |
adapter_model.bin and adapter_config.json: loadable PEFT adapter.adapter_megatron_tp*_pp0.pt: four Megatron tensor-parallel shards.training_state_rank*.pt: per-rank training state.evidence/training/: run receipt, checkpoint manifest, VRAM trace, and
compact evidence summary.evidence/sync_forensics/: rank-by-rank parameter synchronization records.evidence/rollout_dumps/: the training and evaluation rollout tensors.1from peft import PeftModel
2from transformers import AutoModelForCausalLM
3
4base = AutoModelForCausalLM.from_pretrained(
5 "zai-org/GLM-4.7-Flash",
6 trust_remote_code=True,
7)
8model = PeftModel.from_pretrained(
9 base,
10 "TokenBender/glm47-flash-pie-cpp-lora-r16-grpo-h100",
11)