언어: 한국어 (Korean)
도메인: 뉴스 헤드라인 스타일
태스크: Token Classification (Named Entity Recognition)
태깅 스킴: BIO (Begin-Inside-Outside)
생성 방식: 템플릿 기반 합성 데이터 (Synthetic)
Supported Tasks
Token Classification: 각 토큰에 대해 개체명 태그 예측
N-to-N Task: 입력 토큰 시퀀스 -> 태그 시퀀스
Languages
한국어 (Korean, ko)
Dataset Structure… See the full description on the dataset page: https://huggingface.co/datasets/hugmanskj/korean-ner.