Views
No views yet

GPT4 Correct User: Hello<|end_of_turn|>GPT4 Correct Assistant: Hi<|end_of_turn|>GPT4 Correct User: How are you today?<|end_of_turn|>GPT4 Correct Assistant:<|end_of_turn|> as the end-of-generation token.1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3
4# Initialize the model
5model_path = "beowolx/CodeNinja-1.0-OpenChat-7B"
6model = AutoModelForCausalLM.from_pretrained(model_path, device_map="auto")
7# Load the OpenChat tokenizer
8tokenizer = AutoTokenizer.from_pretrained("openchat/openchat-3.5-1210", use_fast=True)
9
10def generate_one_completion(prompt: str):
11 messages = [
12 {"role": "user", "content": prompt},
13 {"role": "assistant", "content": ""} # Model response placeholder
14 ]
15
16 # Generate token IDs using the chat template
17 input_ids = tokenizer.apply_chat_template(messages, add_generation_prompt=True)
18
19 # Produce completion
20 generate_ids = model.generate(
21 torch.tensor([input_ids]).to("cuda"),
22 max_length=256,
23 pad_token_id=tokenizer.pad_token_id,
24 eos_token_id=tokenizer.eos_token_id
25 )
26
27 # Process the completion
28 completion = tokenizer.decode(generate_ids[0], skip_special_tokens=True)
29 completion = completion.split("\n\n\n")[0].strip()
30
31 return completion