Views
No views yet
!pip install -q git+https://github.com/huggingface/transformers.git1import torch
2from transformers import NanoChatForCausalLM, PreTrainedTokenizerFast
3
4# Load the converted model and tokenizer
5tokenizer = PreTrainedTokenizerFast.from_pretrained("pankajmathur/nanochat-d34-sft-hf")
6model = NanoChatForCausalLM.from_pretrained(
7 "pankajmathur/nanochat-d34-sft-hf",
8 torch_dtype=torch.bfloat16,
9 device_map="auto"
10)
11
12# Generate text
13prompt = "Hello, who are you?"
14
15inputs = tokenizer(prompt, return_tensors="pt")
16input_ids = inputs["input_ids"].to(model.device)
17
18with torch.no_grad():
19 outputs = model.generate(
20 input_ids,
21 max_new_tokens=100,
22 do_sample=True,
23 temperature=0.7,
24 top_p=0.9,
25 pad_token_id=tokenizer.eos_token_id
26 )
27
28response = tokenizer.decode(outputs[0], skip_special_tokens=True)
29print(f"🤖 Response:\n{response}")