Views
No views yet
# OCR with Hugging Face Transformerspip:1pip install transformers
2pip install pillow1from transformers import VisionEncoderDecoderModel
2from transformers import TrOCRProcessor, VisionEncoderDecoderModel
3from PIL import Image
4import requests1model = VisionEncoderDecoderModel.from_pretrained("vanshp123/ocrmnist")
2processor = TrOCRProcessor.from_pretrained('microsoft/trocr-base-stage1')"/content/left_digit_section_4.png" with the path to your image:image = Image.open("/content/left_digit_section_4.png").convert("RGB")1pixel_values = processor(images=image, return_tensors="pt").pixel_values
2generated_ids = model.generate(pixel_values)
3generated_text = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]generated_text will contain the text recognized from the image.