Views
No views yet
1from transformers import AutoTokenizer, AutoModel
2tokenizer = AutoTokenizer.from_pretrained('wudejian789/MolMetaLM-small')
3model = AutoModel.from_pretrained('wudejian789/MolMetaLM-small')1smi = "COc1cc2c(cc1OC)CC([NH3+])C2"
2tokenized_smi = tokenizer(" ".join(list(smi)), return_token_type_ids=False,
3 return_tensors='pt', max_length=512, padding='longest', truncation=True)
4emb_smi = model(**tokenized_smi).last_hidden_state
5print(emb_smi.shape) # batch size, seq length, embedding size