Views
No views yet
1from peft import PeftModel, PeftConfig
2from transformers import AutoModelForCausalLM
3
4# Load base model in 4 bit
5model = AutoModelForCausalLM.from_pretrained("meta-llama/Llama-2-7b-hf", load_in_4bit=True)
6
7# Wrap model with pretrained model weights
8config = PeftConfig.from_pretrained("MaziyarPanahi/Llama-2-7b-hf-codealpaca-4bit")
9model = PeftModel.from_pretrained(model, "MaziyarPanahi/Llama-2-7b-hf-codealpaca-4bit", config=config)Below is an instruction that describes a task, paired with an input
that provides further context. Write a response that appropriately
completes the request.
### Instruction: {instruction}
### Input: {input}
### Response:bitsandbytes quantization config was used during training: