Views
No views yet
1# alpaca_prompt = Copied from above
2FastLanguageModel.for_inference(model) # Enable native 2x faster inference
3inputs = tokenizer(
4[
5 alpaca_prompt.format(
6 "Continue the fibonnaci sequence.", # instruction
7 "1, 1, 2, 3, 5, 8", # input
8 "", # output - leave this blank for generation!
9 )
10], return_tensors = "pt").to("cuda")
11
12outputs = model.generate(**inputs, max_new_tokens = 64, use_cache = True)
13tokenizer.batch_decode(outputs)