Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model = AutoModelForCausalLM.from_pretrained("seconds-0/nsa-117m-byte-sft", trust_remote_code=True)
5tokenizer = AutoTokenizer.from_pretrained("seconds-0/nsa-117m-byte-sft", trust_remote_code=True)
6
7prompt = "System: You are a helpful assistant. Answer briefly and clearly.\nUser: What is the capital of France?\nAssistant:"
8inputs = tokenizer(prompt, return_tensors="pt")
9
10with torch.no_grad():
11 outputs = model.generate(**inputs, max_new_tokens=50, temperature=0.7, do_sample=True)
12
13response = tokenizer.decode(outputs[0], skip_special_tokens=True)
14print(response)