Views
No views yet
1from transformers import AutoModelForCausalLM
2model = AutoModelForCausalLM.from_pretrained(
3 "merve/gemma-7b-it-8bit"
4)
5from transformers import AutoTokenizer
6tokenizer =AutoTokenizer.from_pretrained(
7 "google/gemma-7b-it"
8)
9#outputs = model.generate(**input_ids)
10chat = [
11 { "role": "user", "content": "Write a hello world program" },
12]
13prompt = tokenizer.apply_chat_template(chat, tokenize=False, add_generation_prompt=True)
14inputs = tokenizer.encode(prompt, add_special_tokens=True, return_tensors="pt")
15outputs = model.generate(input_ids=inputs.to(model.device), max_new_tokens=150)
16tokenizer.decode(outputs[0])