Views
No views yet

1from unsloth import FastLanguageModel # we use unsloth for faster inference
2import torch
3max_seq_length = 4096
4dtype = None
5load_in_4bit = False
6
7model, tokenizer = FastLanguageModel.from_pretrained(
8 model_name = "mehmetkeremturkcan/oblivionsend",
9 max_seq_length = max_seq_length,
10 dtype = dtype,
11 load_in_4bit = load_in_4bit
12)
13
14from transformers import TextStreamer
15FastLanguageModel.for_inference(model)
16text_streamer = TextStreamer(tokenizer)
17
18inputs = tokenizer(
19[
20"""<start_of_turn>user
21Write a story with the following description: Setting - a dark abandoned watchtower and its environs. A wizard carefully explores a tomb where a priest of a dark, dead God has raised a band of brigands that have been terrorizing a town."""+ """<end_of_turn>
22<start_of_turn>model
23"""
24], return_tensors = "pt").to("cuda")
25
26_ = model.generate(**inputs, streamer = text_streamer, max_new_tokens = 4096, num_beams=1, temperature=1.0, do_sample=True)