Views
No views yet
bitsandbytes library:1from transformers import BitsAndBytesConfig, GPT2LMHeadModel
2
3quantization_config = BitsAndBytesConfig(
4 load_in_8bit=True,
5 bnb_8bit_compute_dtype=torch.bfloat16,
6 bnb_8bit_use_double_quant=True,
7 bnb_8bit_quant_type="nf4",
8)
9
10qmodel = GPT2LMHeadModel.from_pretrained(
11 "ai-forever/mGPT",
12 load_in_8bit=True,
13 torch_dtype=torch.bfloat16,
14 quantization_config=quantization_config,
15 device_map="auto"
16)
17
18qmodel.save_pretrained("model_name")model.save_pretrained() currently throws a NotImplementedError error.