Ce dataset rassemble des paires image + texte en Lingala, destinées à l’entraînement de modèles vision‑language comme Qwen2‑VL, Llava ou Florence.
Il est conçu pour la tâche image‑to‑text, en particulier la transcription OCR de documents, panneaux, affiches, formulaires ou textes manuscrits en Lingala.
Le Lingala étant une langue sous‑représentée dans les systèmes OCR, ce dataset vise à fournir une base… See the full description on the dataset page: https://huggingface.co/datasets/Congo-digital-service/qwen_lingala_dataset.