Views
No views yet
1from transformers import AutoModelForCausalLM, AutoProcessor
2from PIL import Image
3
4# Load model and processor
5model = AutoModelForCausalLM.from_pretrained(
6 "YOUR_USERNAME/OCR-int4-merged",
7 trust_remote_code=True
8)
9processor = AutoProcessor.from_pretrained(
10 "YOUR_USERNAME/OCR-int4-merged",
11 trust_remote_code=True
12)
13
14# Process image
15image = Image.open("document.jpg")
16inputs = processor(images=image, return_tensors="pt")
17
18# Generate OCR output
19outputs = model.generate(**inputs, max_new_tokens=512)
20text = processor.decode(outputs[0], skip_special_tokens=True)
21print(text)