Views
No views yet
1# Prompt
2alpaca_prompt = """Di bawah ini adalah instruksi yang menjelaskan tugas, dipasangkan dengan masukan yang memberikan konteks lebih lanjut. Tulis tanggapan yang melengkapi instruksi dengan tepat.
3
4### Instruksi:
5{}
6
7### Masukan:
8{}
9
10### Tanggapan:
11{}"""
12
13max_seq_length = 4096 # Choose any! We auto support RoPE Scaling internally!
14dtype = None # None for auto detection. Float16 for Tesla T4, V100, Bfloat16 for Ampere+
15load_in_4bit = True # Use 4bit quantization to reduce memory usage. Can be False.
16
17if True:
18 from unsloth import FastLanguageModel
19 model, tokenizer = FastLanguageModel.from_pretrained(
20 model_name = "indo-gemma-2b-alpaca",
21 max_seq_length = max_seq_length,
22 dtype = dtype,
23 load_in_4bit = load_in_4bit
24 )
25 FastLanguageModel.for_inference(model) # Enable native 2x faster inference
26
27inputs = tokenizer(
28 [
29 alpaca_prompt.format(
30 "Sebutkan langkah-langkah membuat nasi goreng!",
31 "", # input
32 "", # output - leave this blank for generation!
33 )
34 ], return_tensors = "pt"
35).to("cuda")
36
37from transformers import TextStreamer
38text_streamer = TextStreamer(tokenizer)
39_ = model.generate(**inputs, streamer = text_streamer, max_new_tokens = 256)