Views
No views yet
1from transformers import (
2 AutoModelForSeq2SeqLM,
3 AutoTokenizer,
4 AutoConfig,
5 pipeline,
6)
7
8model_name = "sagard21/python-code-explainer"
9
10tokenizer = AutoTokenizer.from_pretrained(model_name, padding=True)
11
12model = AutoModelForSeq2SeqLM.from_pretrained(model_name)
13
14config = AutoConfig.from_pretrained(model_name)
15
16model.eval()
17
18pipe = pipeline("summarization", model=model_name, config=config, tokenizer=tokenizer)
19
20raw_code = """
21def preprocess(text: str) -> str:
22 text = str(text)
23 text = text.replace("\n", " ")
24 tokenized_text = text.split(" ")
25 preprocessed_text = " ".join([token for token in tokenized_text if token])
26
27 return preprocessed_text
28"""
29
30print(pipe(raw_code)[0]["summary_text"])
31