Views
No views yet
1pip install transformers==4.49.0
2pip install autoawq==0.2.9
3pip install peft==0.15.01PROMPT = """Sei un esperto redattore di documenti istituzionali italiani.
2
3Sostituisci i connettivi arcaici, formali e burocratici con espressioni comuni. **Non alterare il contenuto e lo stile del testo originale**.
4
5# Steps
61. Leggi attentamente il testo istituzionale e la lista dei connettivi.
72. Individua i connettivi presenti nel testo.
83. Sostituisci, quando possibile, i connettivi individuati con espressioni comuni.
9
10# Output Format
11Il testo modificato con l'originale formattazione e suddivisione in sezioni e paragrafi.
12
13# Notes
14- Il testo fornito può essere complesso e richiede attenzione ai dettagli.
15- Esegui solamente le operazioni descritte, **non eliminare e non modificare altri contenuti**.
16- Assicurati che le implicazioni giuridiche e legali del documento siano mantenute.
17- Non modificare il testo tra virgolette."""
18
19TEXT_TO_SIMPLIFY = """## Testo
20Il documento individua le esigenze di sviluppo necessarie per assicurare che i principi delineati dalla Legge Regionale 23 dicembre 2004, n. 29 e dai successivi atti normativi, sulla essenziale funzione della ricerca e innovazione nelle Aziende Sanitarie della Regione Emilia-Romagna, si traducano in azioni concrete nel Servizio Sanitario Regionale.
21
22Alla luce delle evidenze della letteratura internazionale, delle indicazioni della normativa nazionale e della valutazione di quanto già attuato a livello regionale negli anni passati, vengono individuati gli obiettivi di sviluppo e le linee per il raggiungimento dei suddetti obiettivi.
23
24## Connettivi
25- Alla luce delle"""1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3tokenizer = AutoTokenizer.from_pretrained("VerbACxSS/sempl-it-v3-connectives-awq")
4model = AutoModelForCausalLM.from_pretrained("VerbACxSS/sempl-it-v3-connectives-awq").to("cuda")1chat = [
2 {"role": "system", "content": PROMPT},
3 {"role": "assistant", "content": TEXT_TO_SIMPLIFY},
4]
5
6formatted_chat = tokenizer.apply_chat_template(
7 chat,
8 tokenize=False,
9 add_generation_prompt=True
10)
11model_inputs = tokenizer([formatted_chat], return_tensors="pt").to("cuda")simplified_text:1generated_ids = model.generate(
2 **model_inputs,
3 max_new_tokens=4096,
4 temperature=0.1,
5 top_p=0.2
6)
7simplified_text = tokenizer.decode(generated_ids[0][len(model_inputs.input_ids[0]):], skip_special_tokens=True)
8print(simplified_text)