Views
No views yet
1import torch
2from transformers import GPT2Tokenizer,GPT2Model,GPT2LMHeadModel
3
4model = GPT2LMHeadModel.from_pretrained("dnagpt/gpt_dna_eng_v1")
5tokenizer = GPT2Tokenizer.from_pretrained("dnagpt/dna_eng_bpe")
6
7input = "hello TCTTTCTCTTCTGTAT"
8
9input_ids = tokenizer.encode(
10 input,
11 return_tensors="pt",
12 truncation=True,
13 max_length=1000
14)
15
16# Generate
17device = model.device
18
19generated_tokens = model.generate(
20input_ids=input_ids.to(device),
21max_new_tokens=10,
22)
23
24generated_text = tokenizer.decode(generated_tokens[0], skip_special_tokens=True)
25
26print(generated_text)
27
28#hello TCTTTCTCTTCTGTATATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATCTATC
29
30base_model = GPT2Model.from_pretrained("dnagpt/gpt_dna_eng")
31output = base_model(input_ids)
32print(output)
33