1from transformers import AutoModelForCausalLM, AutoTokenizer, TextGenerationPipeline
2model_path = 'fiveflow/ATOMM'
3tokenizer = AutoTokenizer.from_pretrained(model_path)
4model = AutoModelForCausalLM.from_pretrained(model_path,
5 device_map="auto",
6 # load_in_4bit=True,
7 low_cpu_mem_usage=True)
8
9pipe = TextGenerationPipeline(model = model, tokenizer = tokenizer)