Views
No views yet

1import transformers
2import torch
3
4model_id = "openvoid/Prox-Llama-3-8B"
5
6pipeline = transformers.pipeline(
7 "text-generation",
8 model=model_id,
9 model_kwargs={"torch_dtype": torch.bfloat16},
10 device_map="auto",
11)
12
13messages = [
14 {"role": "system", "content": "You are Prox."},
15 {"role": "user", "content": "Who are you?"},
16]
17
18terminators = [
19 pipeline.tokenizer.eos_token_id,
20 pipeline.tokenizer.convert_tokens_to_ids("<|eot_id|>")
21]
22
23outputs = pipeline(
24 messages,
25 max_new_tokens=256,
26 eos_token_id=terminators,
27 do_sample=True,
28 temperature=0.6,
29 top_p=0.9,
30)
31print(outputs[0]["generated_text"][-1])