Views
No views yet
torch.quantization.quantize_dynamic)1import torch
2from transformers import AutoTokenizer, AutoModelForSeq2SeqLM, pipeline
3
4# Load tokenizer
5tokenizer = AutoTokenizer.from_pretrained("./quantized_model")
6
7# Load quantized model
8model = AutoModelForSeq2SeqLM.from_pretrained("./quantized_model")
9model.eval()
10
11# Run translation
12translator = pipeline("translation_en_to_vi", model=model, tokenizer=tokenizer, device=-1)
13
14text = "Hello, How are you?"
15print("English:", translator(text)[0]['translation_text'])