Views
No views yet
fp16 precision and tf32 for optimized performance.1from transformers import GlmForCausalLM, PreTrainedTokenizerFast
2
3model = GlmForCausalLM.from_pretrained("JohnMarble/vi-en-glm")
4tokenizer = PreTrainedTokenizerFast.from_pretrained("JohnMarble/vi-en-glm")
5
6prompt = "Việt Nam là một quốc gia"
7inputs = tokenizer(prompt, return_tensors="pt", return_token_type_ids=False)
8
9outputs = model.generate(
10**inputs,
11max_length=50,
12do_sample=True,
13top_p=0.9,
14temperature=0.7
15)
16
17print(tokenizer.decode(outputs[0], skip_special_tokens=True))