Views
No views yet
1from unsloth import FastLanguageModel
2import torch
3
4model_name = "Ozin11/deepse-phi-3-mini-time-prediction"
5model, tokenizer = FastLanguageModel.from_pretrained(
6 model_name = model_name,
7 max_seq_length = 2048,
8 load_in_4bit = True,
9)
10FastLanguageModel.for_inference(model)
11
12test_task = 'Fix authentication bug in login module'
13prompt = f'### Instruction:\nPrediksi durasi untuk tugas berikut.\n\n### Input:\n{test_task}\n\n### Response:\n'
14
15inputs = tokenizer([prompt], return_tensors = 'pt').to('cuda')
16outputs = model.generate(**inputs, max_new_tokens = 32)
17response = tokenizer.batch_decode(outputs)[0]
18print(response.split('### Response:')[-1].strip())