Views
No views yet
mistralai/Mistral-7B-Instruct-v0.21from transformers import AutoTokenizer, AutoModelForCausalLM, BitsAndBytesConfig
2import torch
3
4model_id = "ogflash/mistral-merged-1bit-4bit"
5
6bnb_config = BitsAndBytesConfig(
7 load_in_4bit=True,
8 bnb_4bit_quant_type="nf4",
9 bnb_4bit_compute_dtype=torch.float16
10)
11
12tokenizer = AutoTokenizer.from_pretrained(model_id)
13model = AutoModelForCausalLM.from_pretrained(model_id, device_map="auto", quantization_config=bnb_config)
14
15inputs = tokenizer("### Instruction:\nWhat is BitNet B1.58?\n\n### Response:\n", return_tensors="pt").to(model.device)
16outputs = model.generate(**inputs, max_new_tokens=300)
17print(tokenizer.decode(outputs[0], skip_special_tokens=True))