Views
No views yet
from transformers import BertModel, BertTokenizer
import re
pipeline = TextClassificationPipeline(
model=AutoModelForSequenceClassification.from_pretrained("VitaRin/ProtBert-IS"),
tokenizer=AutoTokenizer.from_pretrained("VitaRin/ProtBert-IS"),
device=0
)
sequence = "A E T C Z A O"
sequence = re.sub(r"[UZOB]", "X", sequence)
output = pipeline(sequence)1import re
2
3pipeline = TextClassificationPipeline(
4 model=AutoModelForSequenceClassification.from_pretrained("VitaRin/ProtBert-IS"),
5 tokenizer=AutoTokenizer.from_pretrained("VitaRin/ProtBert-IS"),
6 device=0
7)
8
9with open("input.fasta", "r") as f:
10 data = f.read().split(">")
11
12data.remove(data[0])
13sequences = []
14
15for d in data:
16 d = d.split('\n', 1)[-1].replace('\n', '').replace('', ' ')
17 sequences.append(d)
18
19sequences = [re.sub(r"[UZOB]", "X", sequence) for sequence in sequences]
20print(pipeline(sequences))