Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model_name = "SLT-AI/SLT-0.5b-GoToSpeak"
5
6tokenizer = AutoTokenizer.from_pretrained(model_name)
7model = AutoModelForCausalLM.from_pretrained(
8 model_name,
9 torch_dtype=torch.bfloat16,
10 device_map="auto"
11)
12
13messages = [{"role": "user", "content": "Hello!"}]
14text = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
15inputs = tokenizer(text, return_tensors="pt").to(model.device)
16
17outputs = model.generate(
18 **inputs,
19 max_new_tokens=512,
20 temperature=0.7,
21 top_p=0.9
22)
23
24print(tokenizer.decode(outputs[0], skip_special_tokens=True))