Views
No views yet
transformers + bitsandbytes1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4repo = "rbarohit/gemma3-4b-content-ft-merged-8bit"
5tok = AutoTokenizer.from_pretrained(repo)
6model = AutoModelForCausalLM.from_pretrained(
7 repo,
8 device_map="auto",
9 torch_dtype=torch.float16,
10 load_in_8bit=True,
11)