Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3tokenizer = AutoTokenizer.from_pretrained("ssz1111/GATEAU-5k-10k", trust_remote_code=True)
4model = AutoModelForCausalLM.from_pretrained("ssz1111/GATEAU-5k-10k", torch_dtype=torch.bfloat16, trust_remote_code=True, device_map="auto")
5model = model.eval()
6query = "\n\n Hello."
7response, history = model.chat(tokenizer, query, history=[], max_new_tokens=512, temperature=1)
8print(response)