Views
No views yet

vrs-gemma-2b-it model fine-tuned using LoRA (16-bit precision)1# Running the model on a GPU using different precisions:- For Float16 -
2#!pip install -U transformers
3#!pip install "torch>=2.1.1" -U
4#!pip install accelerate
5#!huggingface-cli login
6from transformers import AutoTokenizer, AutoModelForCausalLM
7import torch
8
9tokenizer = AutoTokenizer.from_pretrained("VijayShinde1996/vrs-gemma-2b-it")
10model = AutoModelForCausalLM.from_pretrained("VijayShinde1996/vrs-gemma-2b-it", device_map="auto", torch_dtype=torch.float16)
11
12input_text = "Write me a poem about Machine Learning."
13input_ids = tokenizer(input_text, return_tensors="pt").to("cuda")
14
15outputs = model.generate(**input_ids, max_length=500)
16print(tokenizer.decode(outputs[0]))