Views
No views yet
1from transformers import LLaMATokenizer, LLaMAForCausalLM, GenerationConfig
2import torch
3
4tokenizer = LLaMATokenizer.from_pretrained("yahma/llama-7b-hf")
5model = LLaMAForCausalLM.from_pretrained(
6 "sag-uniroma2/extremITA-Camoscio-7b",
7 load_in_8bit=True,
8 device_map="auto",
9)
10
11generation_config = GenerationConfig(
12 temperature=0.2,
13 top_p=0.75,
14 top_k=40,
15 num_beams=4,
16)
17
18prompts = [
19 "Riassumi la storia di Pinocchio",
20 "Scrivi un programma che stampa i numeri da 1 a 100. Ma per i multipli \
21 di tre stampa 'Fizz' al posto del numero e per i multipli di cinque \
22 stampa 'Buzz'. Per i numeri che sono multipli sia di tre che di cinque \
23 stampa 'FizzBuzz'."
24]
25
26inputs = tokenizer(prompts, return_tensors="pt", padding=True, \
27 truncation=True).to(model.device)
28
29with torch.no_grad():
30 gen_outputs = model.generate(
31 **inputs,
32 generation_config=generation_config,
33 return_dict_in_generate=True,
34 output_scores=True,
35 )
36
37 for i in range(len(gen_outputs[0])):
38 output = tokenizer.decode(gen_outputs[0][i], skip_special_tokens=True)
39 print(output)@inproceedings{hromei2023extremita,
author = {Claudiu Daniel Hromei and
Danilo Croce and
Valerio Basile and
Roberto Basili},
title = {ExtremITA at EVALITA 2023: Multi-Task Sustainable Scaling to Large Language Models at its Extreme},
booktitle = {Proceedings of the Eighth Evaluation Campaign of Natural Language
Processing and Speech Tools for Italian. Final Workshop (EVALITA 2023)},
publisher = {CEUR.org},
year = {2023},
month = {September},
address = {Parma, Italy}
}