Views
No views yet

1pip install -r requirements.txt
2pip install transformers datasets accelerate safetensors1import torch
2from transformers import AutoModelForCausalLM, AutoTokenizer, TextStreamer
3
4
5device = "cuda" if torch.cuda.is_available() else "cpu"
6model_id = "DireDreadlord/Eagle-1-Mini"
7
8
9tokenizer = AutoTokenizer.from_pretrained(model_id, trust_remote_code=True)
10
11model = AutoModelForCausalLM.from_pretrained(model_id, trust_remote_code=True).to(device).eval()
12
13streamer = TextStreamer(tokenizer, skip_prompt=True, skip_special_tokens=False)
14
15
16prompt = "Give me a python program to implement the fibonacci series."
17
18messages = [
19 {
20 "role": "user",
21 "content": prompt,
22 },
23]
24
25inputs = tokenizer.apply_chat_template(
26 messages,
27 add_generation_prompt=True,
28 return_tensors="pt",
29 return_dict=True,
30)
31inputs = {name: tensor.to(device) for name, tensor in inputs.items()}
32
33
34with torch.inference_mode():
35 output = model.generate(
36 **inputs,
37 max_new_tokens=1024,
38 do_sample=False,
39 repetition_penalty=1.1,
40 pad_token_id=tokenizer.eos_token_id,
41 eos_token_id=tokenizer.eos_token_id,
42 use_cache=True,
43 streamer=streamer
44 )max_new_tokens=1024