Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
2import torch
3
4bnb_config = BitsAndBytesConfig(
5 load_in_4bit=True,
6 bnb_4bit_quant_type="nf4",
7 bnb_4bit_compute_dtype=torch.float16
8)
9
10model = AutoModelForCausalLM.from_pretrained(
11 "Renugadevi82/cisco-nx-ai-4bit",
12 quantization_config=bnb_config,
13 device_map="auto"
14)
15tokenizer = AutoTokenizer.from_pretrained("Renugadevi82/cisco-nx-ai-4bit")