언어 모델과 규칙을 활용한 한국어 문법 항목 자동 주석 연구 추론 라인 A Encoder
이 저장소는 논문 공개 검증용 추론 라인A의 인코더 체크포인트입니다.
용도
이 모델은 한국어 문장에서 아래 문법 항목을 자동 주석하기 위한 공개 실행 예제에 사용됩니다.
ece001: 다면
edf003: ㄴ/은 적 있/없
심사위원 또는 연구자가 GitHub 공개 코드와 함께 이 모델을 내려받아 A 파이프라인 추론을 재현할 수 있도록 공개합니다.
파일 구성
a_best/
├─ encoder/
├─ tokenizer/
└─ head.pt
구성
이 모델은 단독으로 직접 사용하는 것보다, GitHub의 공개 실행 스크립트와 함께 사용하는 것을 권장합니다.
GitHub 저장소의 scripts/run_a_public.py 또는 scripts/run_a_infer.sh에서 이 체크포인트 경로를 지정해 실행하면 됩니다.
공개 범위
이 저장소에는 추론 실행에 필요한 모델 체크포인트만 포함되어 있습니다.
포함되지 않는 항목:
원본 학습 데이터
내부 주석 파일
전체 실험 로그
내부 평가 split
라이선스
기반 모델: team-lucid/deberta-v3-base-korean
기반 모델 라이선스: Apache-2.0
본 fine-tuned checkpoint는 비상업적 연구 및 교육 목적으로만 사용할 수 있습니다.
저자의 사전 서면 허가 없이 본 fine-tuned checkpoint를 상업적 목적으로 사용하는 것은 허용하지 않습니다.
사용자는 기반 모델의 Apache-2.0 라이선스 조건도 함께 준수해야 합니다.