Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model_name = "simecek/cswikimistral_0.1"
5device = "cuda" if torch.cuda.is_available() else "cpu"
6
7tokenizer = AutoTokenizer.from_pretrained(model_name)
8model = AutoModelForCausalLM.from_pretrained(model_name, device_map="auto", load_in_4bit=True)
9
10def generate_text(prompt, max_new_tokens=50):
11 inputs = tokenizer(prompt, return_tensors="pt").to(device)
12 attention_mask = inputs["attention_mask"]
13 input_ids = inputs["input_ids"]
14
15 output = model.generate(
16 input_ids,
17 attention_mask=attention_mask,
18 max_new_tokens=max_new_tokens,
19 num_return_sequences=1,
20 pad_token_id=tokenizer.eos_token_id,
21 )
22
23 return tokenizer.decode(output[0], skip_special_tokens=True)
24
25prompt = "Hlavní město České republiky je"
26generated_text = generate_text(prompt, max_new_tokens=5)
27print(generated_text)