Views
No views yet
pip install transformers accelerate auto-gptq torch1from transformers import AutoTokenizer, pipeline
2
3ModelFolder = "rautaditya/llama-3.2-1b-4bit-gptq"
4tokenizer = AutoTokenizer.from_pretrained(ModelFolder)
5pipe = pipeline(
6 "text-generation",
7 model=ModelFolder,
8 tokenizer=tokenizer,
9 device_map="auto"
10)
11
12prompt = "What is the meaning of life?"
13generated_text = pipe(prompt, max_length=100)
14print(generated_text)1from transformers import AutoTokenizer
2from auto_gptq import AutoGPTQForCausalLM
3
4model_name = "rautaditya/llama-3.2-1b-4bit-gptq"
5tokenizer = AutoTokenizer.from_pretrained(model_name)
6model = AutoGPTQForCausalLM.from_pretrained(
7 model_name,
8 device_map="auto"
9)@misc{llama3.2_4bit_quantized,
title={Llama-3.2 1B 4-bit Quantized Model},
author={Raut, Aditya},
year={2024},
publisher={Hugging Face}
}