This is a GGUF (Q4_K_M) quantized version of
GenomeOcean-100M-v1.2.
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained(
4 "models/GenomeOcean-100M-v1.2-GGUF",
5 gguf_file="model.gguf",
6 device_map="auto"
7)
8tokenizer = AutoTokenizer.from_pretrained("models/GenomeOcean-100M-v1.2-GGUF")
9
10inputs = tokenizer("ATGCGATCGATCGATCGATCG", return_tensors="pt").to("cuda")
11outputs = model.generate(**inputs, max_new_tokens=100)
12print(tokenizer.decode(outputs[0], skip_special_tokens=True))