A high-quality instruction-tuning dataset for building and fine-tuning Konkani Large Language Models (LLMs).
This dataset is designed to improve:
Instruction following
Conversational abilities
Native Konkani understanding
Cultural/domain knowledge
General reasoning and response quality
Total Entries: 50,246
Layer
Description
Entries
Layer 1
Alpaca-style instruction data
8,629