Views
No views yet
/workspace/typst_universe_scrape/outputs/qwen35-9b-merged, itself based on Qwen/Qwen3.5-9B.
For exact reproduction, load this adapter on top of that warm merged model rather than the plain public base.adapter_model.safetensors: exported LoRA adapter weights from the VERL FSDP checkpointadapter_config.json: PEFT adapter configuration1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base_model = "/path/to/qwen35-9b-merged"
5adapter = "uam-rl/qwen35-9b-typst-grpo-lora"
6
7tokenizer = AutoTokenizer.from_pretrained(base_model)
8model = AutoModelForCausalLM.from_pretrained(
9 base_model,
10 torch_dtype="auto",
11 device_map="auto",
12)
13model = PeftModel.from_pretrained(model, adapter)/workspace/eval_results/typst_grpo_real_bf16_sp/checkpoints/global_step_1/actor