Views
No views yet
1
2from transformers import AutoModelForCausalLM, AutoTokenizer
3import torch
4
5model_path = "Ebrahimaabdelghfar/Ubuntu_assistant_TinyLLama"
6torch.backends.cuda.enable_mem_efficient_sdp(False)
7torch.backends.cuda.enable_flash_sdp(False)
8
9tokenizer = AutoTokenizer.from_pretrained(model_path)
10model = AutoModelForCausalLM.from_pretrained(
11 model_path,
12 device_map="auto",
13 torch_dtype='auto'
14).eval()
15
16# Prompt content: "hi"
17messages = [
18 {"role": "user", "content": "hi"}
19]
20
21input_ids = tokenizer.apply_chat_template(conversation=messages, tokenize=True, add_generation_prompt=True, return_tensors='pt')
22output_ids = model.generate(input_ids.to('cuda'))
23response = tokenizer.decode(output_ids[0][input_ids.shape[1]:], skip_special_tokens=True)
24
25# Model response: "Hello! How can I assist you today?"
26print(response)