Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3
4# Load model and tokenizer
5tokenizer = AutoTokenizer.from_pretrained("suresh2001/llama-3.2-1b-instruct-finetuned")
6model = AutoModelForCausalLM.from_pretrained(
7 "suresh2001/llama-3.2-1b-instruct-finetuned",
8 torch_dtype=torch.float16,
9 device_map="auto"
10)
11
12# Generate text
13prompt = "Hello, how are you?"
14inputs = tokenizer(prompt, return_tensors="pt")
15
16with torch.no_grad():
17 outputs = model.generate(
18 **inputs,
19 max_length=100,
20 do_sample=True,
21 temperature=0.7,
22 top_p=0.9,
23 pad_token_id=tokenizer.eos_token_id
24 )
25
26response = tokenizer.decode(outputs[0], skip_special_tokens=True)
27print(response)