Views
No views yet
1from transformers import LlamaTokenizer, LlamaForCausalLM
2import torch
3
4tokenizer = LlamaTokenizer.from_pretrained("Xianjun/Quokka-13b-instruct ")
5model = LlamaForCausalLM.from_pretrained("Xianjun/Quokka-13b-instruct ").half().to("cuda")
6
7instruction = "How to ..."
8batch = tokenizer(instruction, return_tensors="pt", add_special_tokens=False).to("cuda")
9with torch.no_grad():
10 output = model.generate(**batch, max_new_tokens=512, temperature=0.7, do_sample=True)
11 response = tokenizer.decode(output[0], skip_special_tokens=True)1@inproceedings{Yang2024QuokkaAO,
2 title={Quokka: An Open-source Large Language Model ChatBot for Material Science},
3 author={Xianjun Yang and Stephen Wilson and Linda Ruth Petzold},
4 year={2024},
5 url={https://api.semanticscholar.org/CorpusID:266725577}
6}