This repository contains a ResNet + Transformer decoder checkpoint for Khmer OCR, I don’t have a public paper for this model — everything comes from thousands of experiments across different model architectures and datasets.
1from mer import Mer
2
3model = Mer(markdown=True, device='cuda')
4result = model.predict("sample_image.png")
5print("Predicted text:", result)