Views
No views yet
1from transformers import TrOCRProcessor, VisionEncoderDecoderModel
2from PIL import Image
3
4processor = TrOCRProcessor.from_pretrained("umangchaudhari/gujarati-ocr")
5model = VisionEncoderDecoderModel.from_pretrained("umangchaudhari/gujarati-ocr")
6
7image = Image.open("your_gujarati_document.jpg").convert("RGB")
8pixel_values = processor(images=image, return_tensors="pt").pixel_values
9
10generated = model.generate(pixel_values, max_new_tokens=64)
11text = processor.batch_decode(generated, skip_special_tokens=True)[0]
12print(text)