Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer, TextStreamer
2
3tokenizer = AutoTokenizer.from_pretrained("hiyouga/Qwen-14B-Chat-LLaMAfied")
4model = AutoModelForCausalLM.from_pretrained("hiyouga/Qwen-14B-Chat-LLaMAfied", torch_dtype="auto", device_map="auto")
5streamer = TextStreamer(tokenizer, skip_prompt=True, skip_special_tokens=True)
6
7messages = [
8 {"role": "user", "content": "Who are you?"}
9]
10inputs = tokenizer.apply_chat_template(messages, tokenize=True, add_generation_prompt=True, return_tensors="pt")
11inputs = inputs.to("cuda")
12generate_ids = model.generate(inputs, streamer=streamer)python src/cli_demo.py --template qwen --model_name_or_path hiyouga/Qwen-14B-Chat-LLaMAfied| Metric | Value |
|---|---|
| Avg. | 61.60 |
| AI2 Reasoning Challenge (25-Shot) | 57.51 |
| HellaSwag (10-Shot) | 82.11 |
| MMLU (5-Shot) | 65.57 |
| TruthfulQA (0-shot) | 51.99 |
| Winogrande (5-shot) | 72.93 |
| GSM8k (5-shot) | 39.50 |