Views
No views yet
unsloth/llama-3-8b-instruct-bnb-4bit for CEFR-level sentence generation. The base model is available at Mr-FineTuner/llama-3-8b-instruct-base.1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4# Load base model
5base_model = AutoModelForCausalLM.from_pretrained(
6 "Mr-FineTuner/llama-3-8b-instruct-base",
7 quantization_config=BitsAndBytesConfig(load_in_4bit=True),
8 device_map="auto"
9)
10tokenizer = AutoTokenizer.from_pretrained("Mr-FineTuner/llama-3-8b-instruct-base")
11
12# Load LoRA adapters
13model = PeftModel.from_pretrained(base_model, "Mr-FineTuner/noSynthetic-llama_3epoch_02dropout_lora")
14
15# Example inference
16prompt = "<|user|>Generate a CEFR B1 level sentence.<|end|>"
17inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
18outputs = model.generate(**inputs, max_length=50)
19print(tokenizer.decode(outputs[0], skip_special_tokens=True))huggingface_hub. Saved with safetensors for efficiency.