Views
No views yet
1import torch
2from transformers import AutoTokenizer
3from transformers import AutoModelForSeq2SeqLM
4
5tokenizer = AutoTokenizer.from_pretrained("josh-oo/custom-decoder-ats")
6
7##gerpt
8
9#model = AutoModelForSeq2SeqLM.from_pretrained("josh-oo/custom-decoder-ats", trust_remote_code=True, revision="35197269f0235992fcc6b8363ca4f48558b624ff")
10#decoder_tokenizer = AutoTokenizer.from_pretrained("josh-oo/gerpt2")
11
12##dbmdz
13
14model = AutoModelForSeq2SeqLM.from_pretrained("josh-oo/custom-decoder-ats", trust_remote_code=True, revision="4accedbe0b57d342d95ff546b6bbd3321451d504")
15decoder_tokenizer = AutoTokenizer.from_pretrained("josh-oo/german-gpt2-easy")
16decoder_tokenizer.add_tokens(['<</s>>','<<s>>','<<pad>>'])
17
18##
19
20example_text = "In tausenden Schweizer Privathaushalten kümmern sich Haushaltsangestellte um die Wäsche, betreuen die Kinder und sorgen für Sauberkeit. Durchschnittlich bekommen sie für die Arbeit rund 30 Franken pro Stunde Bruttolohn. Der grösste Teil von ihnen erhält aber 28 Franken."
21
22device = torch.device("cuda:0" if torch.cuda.is_available() else "cpu")
23model.to(device)
24model.eval()
25
26test_input = tokenizer([example_text], return_tensors="pt", padding=True, pad_to_multiple_of=1024)
27for key, value in test_input.items():
28 test_input[key] = value.to(device)
29
30outputs = model.generate(**test_input, num_beams=3, max_length=1024)
31decoder_tokenizer.batch_decode(outputs)