Views
No views yet
T5-smallSPRINGLab/IndicVoices-R_Hindi, enriched with synthetic examples for dates, currencies, and units.2e-532 (with gradient accumulation)transformers library:1from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
2
3# Load model and tokenizer
4tokenizer = AutoTokenizer.from_pretrained("shubham-Bgs/Text-normalization-hindi")
5model = AutoModelForSeq2SeqLM.from_pretrained("shubham-Bgs/Text-normalization-hindi")
6
7# Example input
8input_text = "15 / 03 / 1990 को, वैज्ञानिक ने $120 में 500 mg का नमूना खरीदा।"
9inputs = tokenizer(input_text, return_tensors="pt", padding=True)
10
11# Generate normalized text
12outputs = model.generate(**inputs)
13print(tokenizer.decode(outputs[0], skip_special_tokens=True))