Taiwan Culture Llama 70B Training Dataset
Dataset Description
This dataset is specifically prepared for fine-tuning Llama 70B models on Taiwan culture, combining multiple high-quality sources to create a comprehensive training resource.
Dataset Summary
Total Samples: 8352
Language: Traditional Chinese (Taiwan)
Domains: Taiwan Culture, Government QA, Conversational AI, Cultural Knowledge
Format: Instruction-following format optimized for chat models… See the full description on the dataset page: https://huggingface.co/datasets/imhmdf/taiwan-culture-llama-70b-training.