Views
No views yet
1from PIL import Image
2from transformers import TrOCRProcessor, VisionEncoderDecoderModel
3
4hf_model = VisionEncoderDecoderModel.from_pretrained("Serovvans/trocr-prereform-orthography")
5
6image = Image.open("./path/to/your/image")
7
8processor = TrOCRProcessor.from_pretrained("microsoft/trocr-base-printed")
9pixel_values = processor(images=image, return_tensors="pt").pixel_values
10
11generated_ids = hf_model.generate(pixel_values)
12generated_text = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]
13print(generated_text)sudo apt install tesseract-ocrbrew install tesseract-ocrsudo apt-get install poppler-utilsbrew install popplerpip install -r requirements_page.txt1from recognize_page import recognize_page
2
3page_path = "cleaned_pages/C2V10/page11.png"
4text = recognize_page(page_path, text_output_path="output/file.txt")
5
6print(f"Текст страницы:\n")
7print(text)sudo apt install tesseract-ocrbrew install tesseract-ocrsudo apt-get install poppler-utilsbrew install popplerpip install -r requirements_book.txt1from recognize_book import recognize_book
2
3recognize_book(book_path="path/to/your/book.pdf", text_output_path="book_text.txt")