1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3repo = "tjcrims0n/p5-ann"
4tokenizer = AutoTokenizer.from_pretrained(repo)
5model = AutoModelForCausalLM.from_pretrained(repo, device_map="auto")
6
7messages = [
8 {"role": "system", "content": "Answer directly and concisely."},
9 {"role": "user", "content": "Hello."},
10]
11inputs = tokenizer.apply_chat_template(messages, return_tensors="pt", add_generation_prompt=True).to(model.device)
12outputs = model.generate(
13 inputs,
14 max_new_tokens=80,
15 eos_token_id=model.generation_config.eos_token_id,
16 pad_token_id=model.generation_config.pad_token_id,
17)
18print(tokenizer.decode(outputs[0], skip_special_tokens=True))
Local verification passed for greeting, arithmetic, and code prompts after removing stale remote-code hooks from config.json.