Views
No views yet

1from transformers import VisionEncoderDecoderModel, TrOCRProcessor
2import torch
3from PIL import Image
4
5# Load model and processor
6processor = TrOCRProcessor.from_pretrained("anuashok/ocr-captcha-v2")
7model = VisionEncoderDecoderModel.from_pretrained("anuashok/ocr-captcha-v2")
8
9# Load image
10image = Image.open('path_to_your_image.jpg').convert("RGB")
11
12# Prepare image
13pixel_values = processor(image, return_tensors="pt").pixel_values
14
15# Generate text
16generated_ids = model.generate(pixel_values)
17generated_text = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]
18print(generated_text)