Views
No views yet
Qwen/Qwen3-4B-Thinking-2507, fine-tuned for a CSE 151B
math/statistics reasoning competition.1from peft import PeftModel
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4base = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3-4B-Thinking-2507", dtype="bfloat16")
5model = PeftModel.from_pretrained(base, "Ekkoliu/qwen3-4b-thinking-2507-math-lora")
6tok = AutoTokenizer.from_pretrained("Qwen/Qwen3-4B-Thinking-2507")1from vllm import LLM
2from vllm.lora.request import LoRARequest
3llm = LLM("Qwen/Qwen3-4B-Thinking-2507", enable_lora=True, max_lora_rank=32)
4# pass lora_request=LoRARequest("adapter", 1, "<local_or_hub_path>") to llm.chat(...)