Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer, pipeline
2
3tokenizer = "meta-llama/Llama-2-7b-chat-hf"
4model_id = "CRE_llama_fewrel_1_memory_10_2"
5tokenizer = AutoTokenizer.from_pretrained(model_id, use_auth_token=True)
6model = AutoModelForCausalLM.from_pretrained(
7 model_id,
8 device_map="auto",
9 load_in_4bit=True, # Requires bitsandbytes
10 torch_dtype="auto"
11)
12