Aquesta base de dades conté 16.000 línies en català sense faltes d'ortografia, ideal per entrenar models de llenguatge com seq2seq, IA conversacional, o sistemes d'anàlisi lingüística.
Contingut
Idioma: Català
Format: Text estructurat amb etiquetes com [INSTRUCCIÓ] i [SORTIDA].
Ús: Entrenament de models IA (GPT, T5, etc.) o altres aplicacions lingüístiques.