Views
No views yet
1from unsloth import FastLanguageModel
2import torch
3
4model, tokenizer = FastLanguageModel.from_pretrained(
5 model_name = "/kaggle/working/darija_qwen_lora_adapter",
6 max_seq_length = 512,
7 dtype = torch.float16,
8 load_in_4bit = True,
9)
10FastLanguageModel.for_inference(model)