Views
No views yet

transformers and accelerate libraries in order to run this model. Then, you basically have to run the following code:1
2from transformers import AutoModelForCausalLM, AutoTokenizer, GenerationConfig
3import torch
4
5model_name_or_id = "NucleusOrg/Nucleus-1B-alpha-1"
6
7model = AutoModelForCausalLM.from_pretrained(model_name_or_id, torch_dtype=torch.float16, device_map="cuda")
8tokenizer = AutoTokenizer.from_pretrained(model_name_or_id)
9
10prompt = "### Lesson: Python Programming 101\n### Introduction\n"
11
12inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
13
14generation_config = GenerationConfig(
15 do_sample=True,
16 top_k=1,
17 temperature=0.9,
18 max_new_tokens=500,
19 repetition_penalty=1.5,
20 pad_token_id=tokenizer.eos_token_id
21)
22
23outputs = model.generate(**inputs, generation_config=generation_config)
24print(tokenizer.decode(outputs[0], skip_special_tokens=True))
25### Chapter 1: Elon Musk and Iron Man
Elon met Tony at a Cafe in Monaco, then they had a conversation aboutQuestion: Who are you?
Answer: