Views
No views yet
1import torch
2from peft import PeftModel
3from transformers import AutoProcessor, Qwen2AudioForConditionalGeneration, BitsAndBytesConfig, Gemma3nForConditionalGeneration
4
5model = "google/gemma-3n-E4B-it"
6bnb_config = BitsAndBytesConfig(
7 load_in_4bit=True,
8 bnb_4bit_use_double_quant=True,
9 bnb_4bit_quant_type="nf4",
10 bnb_4bit_compute_dtype=torch.bfloat16
11)
12
13processor = AutoProcessor.from_pretrained(model,
14 cache_dir = os.getenv('CACHE_DIR'))
15
16base_model = Gemma3nForConditionalGeneration.from_pretrained(
17 model,
18 device_map="auto",
19 quantization_config=bnb_config,
20 torch_dtype=torch.bfloat16,
21 cache_dir = os.getenv('CACHE_DIR')
22)
23
24model = PeftModel.from_pretrained(base_model, "binhquoc/alm-add-gemma-rsn")
25model.eval()