Views
No views yet
Qwen/Qwen2.5-7B-Instruct with PEFT.f1dfb89164225c3f1f107a486271acab6c2d076e791241360bdc0d6466e416e2Qwen2ForCausalLM.from_pretrained('Qwen/Qwen2.5-7B-Instruct', quantization_config=NF4, attn_implementation="sdpa") plus PeftModel.from_pretrained(...)primary_v3 two-phase decoding