Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "swap-uniba/LLaMAntino-2-chat-7b-hf-ITA"
4
5tokenizer = AutoTokenizer.from_pretrained(model_id)
6model = AutoModelForCausalLM.from_pretrained(model_id)
7
8prompt = "Scrivi qui un possibile prompt"
9
10input_ids = tokenizer(prompt, return_tensors="pt").input_ids
11outputs = model.generate(input_ids=input_ids)
12
13print(tokenizer.batch_decode(outputs.detach().cpu().numpy()[:, input_ids.shape[1]:], skip_special_tokens=True)[0])model = AutoModelForCausalLM.from_pretrained(model_id, load_in_8bit=True)1@misc{basile2023llamantino,
2 title={LLaMAntino: LLaMA 2 Models for Effective Text Generation in Italian Language},
3 author={Pierpaolo Basile and Elio Musacchio and Marco Polignano and Lucia Siciliani and Giuseppe Fiameni and Giovanni Semeraro},
4 year={2023},
5 eprint={2312.09993},
6 archivePrefix={arXiv},
7 primaryClass={cs.CL}
8}