Corpus de entrenamiento en español usado para el fine-tuning del modelo qwen35b-espanol basado en Qwen3.6-35B-A3B.
Este dataset contiene 200.000 registros de texto en español, orientados al entrenamiento de modelos de lenguaje conversacional. Cada registro tiene un único campo text con contenido continuo en español, principalmente noticias y artículos de contexto chileno.
Formato: JSONL
Registros:… See the full description on the dataset page:
https://huggingface.co/datasets/jpalmae/qwen35b-espanol-dataset-200k.