WenetSpeech-Formal is a Chinese speech dataset built upon WenetSpeech, augmented with formal written-style transcriptions. Each audio sample contains two levels of transcription:
Field
Description
original_text
Original verbatim transcription(口语原文,含口语习惯表达)