NuosuBburma OCR Evaluation Set
规范彝文 OCR 评估集
用于规范彝文(NuosuBburma)的模型性能评估与错误分析。
内容涵盖纯彝文、彝汉混排及少量含拉丁字母的混排文本;场景覆盖书籍、手写、屏幕和实拍。
真实性声明:全部评估样本来自真实扫描或实际拍摄,不含合成评估数据。
输入为单张包含规范彝文、彝汉混排及少量拉丁字母、数字或标点的图像。模型按照图像中的视觉阅读顺序转写可见文字,保留必要的行结构和原有字符,不进行翻译、改写或文本补全。评估重点是复杂版式、混排文字和真实拍摄干扰条件下的文字识别能力。