Views
No views yet
1from transformers import EncoderDecoderModel, AutoTokenizer, GenerationConfig
2from adapters import init
3
4model_path = "leaBroe/Heavy2Light"
5subfolder_path = "heavy2light_final_checkpoint"
6
7model = EncoderDecoderModel.from_pretrained(model_path)
8
9tokenizer = AutoTokenizer.from_pretrained(model_path, subfolder=subfolder_path)
10
11init(model)
12adapter_name = model.load_adapter("leaBroe/Heavy2Light_adapter", set_active=True)
13model.set_active_adapters(adapter_name)
14
15generation_config = GenerationConfig.from_pretrained(model_path)
16
17# example input heavy sequence
18heavy_seq = "QLQVQESGPGLVKPSETLSLTCTVSGASSSIKKYYWGWIRQSPGKGLEWIGSIYSSGSTQYNPALGSRVTLSVDTSQTQFSLRLTSVTAADTATYFCARQGADCTDGSCYLNDAFDVWGRGTVVTVSS"
19
20inputs = tokenizer(
21 heavy_seq,
22 padding="max_length",
23 truncation=True,
24 max_length=250,
25 return_tensors="pt"
26)
27
28generated_seq = model.generate(
29 input_ids=inputs.input_ids,
30 attention_mask=inputs.attention_mask,
31 num_return_sequences=1,
32 output_scores=True,
33 return_dict_in_generate=True,
34 generation_config=generation_config,
35 bad_words_ids=[[4]],
36 do_sample=True,
37 temperature=1.0,
38)
39
40generated_text = tokenizer.decode(
41 generated_seq.sequences[0],
42 skip_special_tokens=True,
43)
44
45print("Generated light sequence:", generated_text)