Views
No views yet

1import torch
2from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
3
4tokenizer = AutoTokenizer.from_pretrained("efederici/it5-efficient-small-lfqa")
5model = AutoModelForSeq2SeqLM.from_pretrained("efederici/it5-efficient-small-lfqa")
6
7query = "con chi si era messo in contatto elon musk?"
8
9# concatenated texts/document text
10doc = """
11La notizia dell’acquisizione da parte di Elon Musk del 9,2 per cento delle azioni di Twitter e del suo successivo ingresso nel consiglio di amministrazione della società hanno attirato grandi attenzioni, non solo da parte degli analisti finanziari, ma anche di chi si occupa di social media e del modo in cui viene impiegata la piattaforma da centinaia di milioni di persone in tutto il mondo. Musk, che ha un grande seguito su Twitter, in passato aveva più volte criticato il social network, accusandolo di non tutelare a sufficienza le libertà di espressione, anche in casi limite come l’assalto al Congresso degli Stati Uniti del 2021.
12Alcune settimane fa, Musk si era messo in contatto con Parag Agrawal, CEO di Twitter da fine novembre 2021, e con il suo predecessore e cofondatore della società, Jack Dorsey, annunciando di avere avviato l’acquisizione di alcune quote dell’azienda e di essere disponibile per discutere di soluzioni per migliorarla. Secondo fonti del New York Times, dopo i primi contatti, Agrawal aveva proposto a Musk di avere un ruolo più attivo oltre a quello di azionista, offrendogli la possibilità di entrare nel consiglio di amministrazione.
13"""
14
15query_and_docs = f"Domanda: {query} Contesto: {doc}"
16
17model_input = tokenizer(query_and_docs, truncation=True, padding=True, return_tensors="pt")
18
19output = model.generate(
20 input_ids=model_input["input_ids"],
21 attention_mask=model_input["attention_mask"],
22 min_length=10,
23 max_length=256,
24 do_sample=False,
25 early_stopping=True,
26 num_beams=8,
27 temperature=1.0,
28 top_k=None,
29 top_p=None,
30 no_repeat_ngram_size=3,
31 num_return_sequences=1
32)
33
34tokenizer.batch_decode(output, skip_special_tokens=True, clean_up_tokenization_spaces=True)