Views
No views yet
1from transformers import DonutProcessor, VisionEncoderDecoderModel
2from huggingface_hub import hf_hub_download
3from PIL import Image
4
5processor = DonutProcessor.from_pretrained("ajmaclin/prescription-donut-ocr")
6model = VisionEncoderDecoderModel.from_pretrained("ajmaclin/prescription-donut-ocr")
7
8image = Image.open("prescription_crop.jpg")
9pixel_values = processor(image, return_tensors="pt").pixel_values
10outputs = model.generate(pixel_values, max_length=256)
11result = processor.batch_decode(outputs, skip_special_tokens=True)[0]
12print(result)