Dataset Card for "moss-003-sft-chinese-zhtw"
資料集摘要
本資料集主要是應用於專案:MOSS: 開源對話語言模型 所收集的數據。
MOSS 是支援中英雙語和多種外掛程式的開源對話語言模型,moss-moon 系列模型具有160億參數,在FP16精度下可在單張A100/A800或兩張3090顯示卡運行,在INT4/8精度下可在單張3090顯示卡運行。 MOSS基座語言模型在約七千億中英文以及程式碼單字上預訓練得到,後續經過對話指令微調、插件增強學習和人類偏好訓練具備多輪對話能力及使用多種插件的能力。
moss-003-sft-data: moss-moon-003-sft 所使用的多輪對話數據,基於 MOSS-002 內測階段採集的約10萬用戶輸入數據和 gpt-3.5-turbo 構造而成,相比 moss-002-sft-data,moss-003-sft-data… See the full description on the dataset page:
https://huggingface.co/datasets/erhwenkuo/moss-003-sft-chinese-zhtw.