Views
No views yet
1from transformers import TrOCRProcessor, VisionEncoderDecoderModel
2from PIL import Image
3
4processor = TrOCRProcessor.from_pretrained("Sprakbanken/TrOCR-norhand-v3")
5model = VisionEncoderDecoderModel.from_pretrained("Sprakbanken/TrOCR-norhand-v3")
6
7image = Image.open("path_to_image.jpg").convert("RGB")
8
9pixel_values = processor(image, return_tensors="pt").pixel_values
10generated_ids = model.generate(pixel_values)
11
12generated_text = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]