Views
No views yet
Trainer on an accelerated NVIDIA GPU cluster.3.4782.988~1.121import torch
2from transformers import AutoTokenizer, AutoModelForCausalLM, pipeline
3
4model_id = "agentbyumer/mini-gemma"
5
6tokenizer = AutoTokenizer.from_pretrained(model_id)
7model = AutoModelForCausalLM.from_pretrained(
8 model_id,
9 torch_dtype=torch.float16,
10 device_map="auto"
11)
12
13generator = pipeline("text-generation", model=model, tokenizer=tokenizer)
14
15prompt = "Your specialized prompt here"
16outputs = generator(
17 prompt,
18 max_new_tokens=150,
19 do_sample=True,
20 temperature=0.7,
21 return_full_text=False
22)
23print(outputs[0]['generated_text'])