Views
No views yet
1# !pip install transformers==4.52.4
2import torch
3from peft import PeftModel
4from transformers import AutoProcessor, AutoModelForCausalLM, BitsAndBytesConfig, AutoModelForSpeechSeq2Seq
5
6model_id = "ibm-granite/granite-speech-3.3-8b"
7
8bnb_config = BitsAndBytesConfig(
9 load_in_4bit=True,
10 bnb_4bit_use_double_quant=True,
11 bnb_4bit_quant_type="nf4",
12 bnb_4bit_compute_dtype=torch.bfloat16
13)
14
15base_model = AutoModelForSpeechSeq2Seq.from_pretrained(model_id,
16 device_map="auto",
17 torch_dtype=torch.bfloat16,
18 quantization_config=bnb_config,
19 cache_dir = os.getenv('CACHE_DIR'))
20
21model = PeftModel.from_pretrained(base_model, "binhquoc/alm-add-granite-rsn")
22
23processor = AutoProcessor.from_pretrained(model_id, cache_dir = os.getenv('CACHE_DIR'))