Views
No views yet
git-lfs for model filestransformers in Python as follows:1from transformers import TrOCRProcessor, VisionEncoderDecoderModel
2from PIL import Image
3
4# Load model and processor
5processor = TrOCRProcessor.from_pretrained("Gitesh2003/TrOCR")
6model = VisionEncoderDecoderModel.from_pretrained("Gitesh2003/TrOCR")
7
8# Load an image
9image = Image.open("handwritten_sample.jpg").convert("RGB")
10
11# Process and predict text
12pixel_values = processor(images=image, return_tensors="pt").pixel_values
13generated_ids = model.generate(pixel_values)
14extracted_text = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]
15
16print("Extracted Text:", extracted_text)
17