Views
No views yet
microsoft/trocr-base-handwritten optimisée pour la lecture de documents manuscrits dans le cadre d'un projet de Master en Informatique au Sénégal. Il fait partie d'un pipeline complet visant à numériser les formulaires d'autopsie verbale pour les services de santé publique.1from transformers import TrOCRProcessor, VisionEncoderDecoderModel
2from PIL import Image
3
4processor = TrOCRProcessor.from_pretrained("ton-pseudo/trocr-autopsie-verbale-senegal")
5model = VisionEncoderDecoderModel.from_pretrained("ton-pseudo/trocr-autopsie-verbale-senegal")
6
7image = Image.open("chemin_vers_crop_manuscrit.jpg").convert("RGB")
8pixel_values = processor(image, return_tensors="pt").pixel_values
9generated_ids = model.generate(pixel_values)
10generated_text = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]
11print(generated_text)