Views
No views yet
codellama/CodeLlama-7b-hf.dummy-CodeLlama-7b-hf has a size of 888.04 MB instead of the original 12852.88 MB (compression factor of 14.47) but keeps the base model's functionality.1# pip install transformers accelerate
2
3from transformers import AutoModelForCausalLM, AutoTokenizer
4import torch
5
6model = "dummy-CodeLlama-7b-hf"
7
8tokenizer = AutoTokenizer.from_pretrained(model)
9model = AutoModelForCausalLM.from_pretrained(
10 model,
11 low_cpu_mem_usage=True,
12 return_dict=True,
13 torch_dtype=torch.float16,
14 device_map={"": 0},
15)