Views
No views yet
1
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4model_path = "mrcuddle/Tiny-DarkLlama-Chat"
5
6tokenizer = AutoTokenizer.from_pretrained(model_path)
7model = AutoModelForCausalLM.from_pretrained(
8 model_path,
9 device_map="auto",
10 torch_dtype='auto'
11).eval()
12
13# Prompt content: "hi"
14messages = [
15 {"role": "user", "content": "hi"}
16]
17
18input_ids = tokenizer.apply_chat_template(conversation=messages, tokenize=True, add_generation_prompt=True, return_tensors='pt')
19output_ids = model.generate(input_ids.to('cuda'))
20response = tokenizer.decode(output_ids[0][input_ids.shape[1]:], skip_special_tokens=True)
21
22# Model response: "Hello! How can I assist you today?"
23print(response)| Tasks | Version | Filter | n-shot | Metric | Value | Stderr | ||
|---|---|---|---|---|---|---|---|---|
| hellaswag | 1 | none | 0 | acc | ↑ | 0.4659 | ± | 0.0050 |
| none | 0 | acc_norm | ↑ | 0.6044 | ± | 0.0049 | ||
| lambada_openai | 1 | none | 0 | acc | ↑ | 0.6101 | ± | 0.0068 |
| none | 0 | perplexity | ↓ | 5.9720 | ± | 0.1591 |