Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
2import transformers
3import torch
4
5model_name = "jwnder/core42_jais-30b-chat-v3-bnb-4bit"
6
7import warnings
8warnings.filterwarnings('ignore')
9
10tokenizer = AutoTokenizer.from_pretrained(model_input_folder, trust_remote_code=True)
11model = AutoModelForCausalLM.from_pretrained(model_input_folder, trust_remote_code=True)
12
13inputs = tokenizer("Testing LLM!", return_tensors="pt")
14outputs = model.generate(**inputs)
15print(tokenizer.batch_decode(outputs, skip_special_tokens=True))
16