Views
No views yet
Qwen/Qwen3.5-27B on the
ZhuofengLi/hardtests-sft-qwen3.5-27b
dataset (reward=1 competitive-programming trajectories with reasoning).adapter_config.json)1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3.5-27B", torch_dtype="bfloat16", device_map="auto")
5model = PeftModel.from_pretrained(base, "ZhuofengLi/hardtests-sft-qwen3.5-27b-epoch1")
6model = model.merge_and_unload()
7model.save_pretrained("./qwen3.5-27b-hardtests-sft-epoch1-merged")
8AutoTokenizer.from_pretrained("Qwen/Qwen3.5-27B").save_pretrained("./qwen3.5-27b-hardtests-sft-epoch1-merged")