A curated code perplexity evaluation corpus — 9,324 lines of real-world, working code across 24 files and 5 programming languages.
Source: github.com/sapbotgit/code-doodles
This dataset is designed to measure code perplexity (PPL) — how well a language model predicts actual hand-written code across multiple languages and programming paradigms.
JavaScript… See the full description on the dataset page:
https://huggingface.co/datasets/sapbot/coderppl.