Views
No views yet
Qwen/Qwen2.5-3B-InstructGRPOTrainer + Unsloth (real run; curves/logs in the project repo)1# pip install -U transformers peft torch
2from transformers import AutoModelForCausalLM, AutoTokenizer
3from peft import PeftModel
4
5base_id = "Qwen/Qwen2.5-3B-Instruct"
6adapter_id = "COolAlien35/aic-grpo-adapter-14"
7
8tok = AutoTokenizer.from_pretrained(base_id)
9base = AutoModelForCausalLM.from_pretrained(base_id, device_map="auto")
10model = PeftModel.from_pretrained(base, adapter_id)
11
12# now use `model.generate(...)` normally