Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4# Load base model
5base_model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3-14B")
6tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen3-14B")
7
8# Load GRPO adapter
9model = PeftModel.from_pretrained(base_model, "kylebrussell/cap-rlvr-grpo-bluebook")
10
11# Use for bluebook tasks
12inputs = tokenizer("Your bluebook query here", return_tensors="pt")
13outputs = model.generate(**inputs, max_new_tokens=200)
14response = tokenizer.decode(outputs[0], skip_special_tokens=True)1@misc{cap-rlvr-grpo-bluebook,
2 title={CAP RLVR GRPO Model for Bluebook Tasks},
3 author={CAP RLVR Team},
4 year={2025},
5 howpublished={\url{https://huggingface.co/kylebrussell/cap-rlvr-grpo-bluebook}}}