A rebuilt, leakage-proof, multi-task training dataset for teaching
vision-language models (target: Qwen3-VL-8B-Instruct LoRA) to visually
read, transliterate, and translate Sumerian cuneiform tablets from
photographs. The mission: produce useful first-pass readings for the ~90% of
excavated tablets that have never been published or translated.
Current release: v1.0.0 — 455,506 records (402,004… See the full description on the dataset page:
https://huggingface.co/datasets/Manusagents/Sumtables-Cuneiform-Full-Fable5-Remaster.