Views
No views yet
<base-model>/<rule>__from_<init>/:.
└── qwen3-4b-instruct-2507/ # base = Qwen/Qwen3-4B-Instruct-2507
├── max_plus_diff__from_fewshot/
├── max_plus_diff__from_explicit/
├── digit_product__from_fewshot/
└── ... (11 rules × 2 inits = up to 22)adapter_config.jsonadapter_model.safetensorsREADME.md (per-variant details)trainer_state.json (training-time metrics)1from peft import PeftModel
2from transformers import AutoModelForCausalLM
3
4base = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3-4B-Instruct-2507", torch_dtype="bfloat16")
5model = PeftModel.from_pretrained(base, "ada-flo/monkey-grpo-arith_op", subfolder="qwen3-4b-instruct-2507/max_plus_diff__from_fewshot")