This dataset contains 3,000 synthetic samples designed to improve LLM performance on complex structured data conversion, extraction, and formatting tasks.
It features a perfectly balanced distribution across 5 major data formats, ensuring comprehensive coverage of structural logic.
Dataset Summary
The dataset consists of 3,000 samples, with an equal allocation of 20% (600 samples) for each target format.