Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained(
4 "./gemma-2b-trader-8bit",
5 load_in_8bit=True,
6 device_map="auto"
7)
8tokenizer = AutoTokenizer.from_pretrained("./gemma-2b-trader-8bit")
9
10# Same usage as fp16 version