Este conjunto de datos es una traducción del dataset Clean Alpaca al Español y sirve como referencia para el esfuerzo colaborativo de limpieza y mejora del dataset durante el Hackathon Somos NLP 2023. Nota: No es necesario participar en el hackathon para contribuir a esta tarea.
Cuantas más personas y equipos participen mayor será la calidad del dataset final y por lo tanto también del LLM que entrenemos, ¡únete!
Te explicamos como… See the full description on the dataset page:
https://huggingface.co/datasets/somosnlp/somos-clean-alpaca-es.