Views
No views yet
bitsandbytesconfig.jsongeneration_config.jsonmodel.safetensors (4-bit quantized weights)tokenizer.jsontokenizer_config.jsonspecial_tokens_map.jsonchat_template.jinjaload_in_4bit=True.1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_name = "Shlok307/llama-1b-4bit"
4
5tokenizer = AutoTokenizer.from_pretrained(model_name)
6
7model = AutoModelForCausalLM.from_pretrained(
8 model_name,
9 load_in_4bit=True,
10 device_map="auto"
11)