O dataset Selena é um conjunto de dados finamente curado em Português (pt-BR) projetado especificamente para otimizar modelos de linguagem (LLMs) a ter pensamento.
Estrutura do Dataset
Os dados estão estruturados no formato JSON, contendo pares de instrução direta e saídas criativas de alta qualidade.