Views
No views yet
Aarif1430/english-to-hindi dataset and optimized using dynamic quantization for efficient CPU inference.Helsinki-NLP/opus-mt-en-hitorch.quantization.quantize_dynamic)1import torch
2from transformers import AutoTokenizer, AutoModelForSeq2SeqLM, pipeline
3
4# Load tokenizer
5tokenizer = AutoTokenizer.from_pretrained("./quantized_model")
6
7# Load quantized model
8model = AutoModelForSeq2SeqLM.from_pretrained("./quantized_model")
9model.eval()
10
11# Run translation
12translator = pipeline("translation_en_to_hi", model=model, tokenizer=tokenizer, device=-1)
13
14text = "How are you?"
15print("Hindi:", translator(text)[0]['translation_text'])