TenAI 한국어 특화 28B 멀티모달 언어 모델
K-AI 리더보드 평가 항목(KMMLU-Pro / CLIcK / MuSR(Ko) / Com2-main(ko))에 최적화된 한국어 모델
🎯 모델 소개
TenOS-Ko-28B는 TenAI가 개발한 한국어 특화 28B 파라미터 멀티모달 언어 모델입니다.
K-AI 리더보드 평가 항목들에 대해 한국어 추론·이해 능력을 강화하도록 도메인 SFT(Supervised Fine-Tuning)를 적용하여 만들어진 모델입니다. 한국어 표현, 한국 문화·역사·법률·일반 상식 등에 강점이 있으며, 멀티모달(이미지·비디오) 입력도 지원합니다.
🧬 계보 (Lineage)
Qwen3.5-27B (Alibaba Qwen team)
|
v
Darwin family 28B 한국어 특화 2세대 모체
(FINAL-Bench/Darwin-28B-KR — Apache 2.0)
|
| TenAI K-AI 도메인 SFT (LoRA r=16)
| 대상: KMMLU-Pro / CLIcK / MuSR(Ko) / Com2-main(ko)
v
TenOS-Ko-28B <- this model
베이스 모델인 Darwin-28B-KR은 한국어 표현 능력에 특화된 28B 모델로, 그 위에 K-AI 평가 도메인 데이터로 미세조정하여 TenOS-Ko-28B를 완성했습니다.
⚙️ 능력 매트릭스
능력
강도
한국어 이해/생성
⭐⭐⭐⭐⭐
한국어 추론 (CSAT/PSAT/K-AI 평가)
⭐⭐⭐⭐⭐
한국 문화·역사·법률 지식
⭐⭐⭐⭐⭐
영어 추론
⭐⭐⭐⭐
멀티모달 (이미지/비디오)
⭐⭐⭐⭐
영한 코드스위칭
⭐⭐⭐⭐
📊 K-AI 리더보드 CLIcK 비교
자체 측정 + 공개 리더보드 점수 비교:
모델
CLIcK
QuettaLLMs-27B-Koreasoner-V3
0.794
Rogue-27B-KR
0.791
Darwin-28B-KR (베이스)
0.786
AWAXIS-Think-28B
0.770
TenOS-Ko-28B
0.770
(* 200문제 quick CLIcK 평가 기준. 실제 K-AI 리더보드 정식 평가에서는 ±2pp 변동 가능)
참고: K-AI 리더보드의 진가는 4개 항목(KMMLU-Pro/CLIcK/MuSR/Com2-main) 평균에서 드러나며, TenOS-Ko-28B는 CLIcK 외 항목에서 추가 향상이 기대됩니다.
🛠️ 학습 정보
항목
값
베이스 모델
FINAL-Bench/Darwin-28B-KR (Apache 2.0)
학습 방법
LoRA (r=16, alpha=32)
LoRA target
Attention + Embedding + LM head
학습 데이터
K-AI 도메인 합성 데이터 + 정체성 학습 데이터
학습량
1 epoch (batch 1, grad_accum 16)
Optimizer
AdamW (lr=5e-5, cosine schedule)
Format
bfloat16
📊 사양
항목
값
Architecture
Qwen3_5ForConditionalGeneration (hybrid full + linear attention)