Views
No views yet
microsoft/Phi-4-mini-instructFreedomIntelligence/medical-o1-reasoning-SFT (config: en)1from transformers import AutoTokenizer, AutoModelForCausalLM, BitsAndBytesConfig
2from peft import PeftModel
3import torch
4
5base_id = "microsoft/Phi-4-mini-instruct"
6adapter_id = "prajwalg1997/phi4mini-medical-lora2"
7
8tokenizer = AutoTokenizer.from_pretrained(base_id, trust_remote_code=True)
9if tokenizer.pad_token is None:
10 tokenizer.pad_token = tokenizer.eos_token
11
12bnb = BitsAndBytesConfig(load_in_4bit=True, bnb_4bit_quant_type="nf4",
13 bnb_4bit_use_double_quant=True, bnb_4bit_compute_dtype=torch.float16)
14
15base = AutoModelForCausalLM.from_pretrained(
16 base_id, device_map="auto", trust_remote_code=True,
17 quantization_config=bnb, attn_implementation="sdpa"
18)
19model = PeftModel.from_pretrained(base, adapter_id)
20model.eval()temperature=0.2, do_sample=False, max_new_tokens≈256–512