Views
No views yet
| Parameter | Value |
|---|---|
| Batch Size | 2 |
| Gradient Accumulation | 4 |
| Learning Rate | 2e-4 |
| Epochs | 1 |
| Quantization | 4-bit |
1from unsloth import FastLanguageModel
2
3model, tokenizer = FastLanguageModel.from_pretrained(
4 model_name="your-username/your-repo-name",
5 load_in_4bit=True,
6)
7
8FastLanguageModel.for_inference(model)
9
10messages = [{"role": "user", "content": "How do I treat blight in tomatoes?"}]
11inputs = tokenizer.apply_chat_template(
12 messages, tokenize=True, add_generation_prompt=True, return_tensors="pt"
13).to("cuda")
14
15outputs = model.generate(input_ids=inputs, max_new_tokens=256)
16print(tokenizer.decode(outputs[0], skip_special_tokens=True))