Views
No views yet
lm_head 레벨에서 중국어, 일본어, 러시아어에 토큰을 마스킹하여 Language Confusion을 억제하고 한국어 생성 능력을 보존하는 것을 목표로 합니다.| Model Variant | K-MMBench | K-SEED | K-MMStar | K-DTCBench | K-LLAVA-W |
|---|---|---|---|---|---|
| baseline | 80.39% 0.12% (5 / 4329) | 77.08% 0% | 52.60% 0.60% (9 / 1500) | 76.67% 0% | 89.08% 15.00% (9 / 60) |
| weight_masking | 80.39% 0.02% (1 / 4329) | 77.08% 0% | 52.53% 0.00% (0 / 1500) | 76.67% 0% | 87.70% 1.67% (1 / 60) |
1from transformers import Qwen2_5_VLForConditionalGeneration, AutoProcessor
2
3model = Qwen2_5_VLForConditionalGeneration.from_pretrained("mncai/hunminVL_32B_v0.1_20250724", device_map="auto")
4processor = AutoProcessor.from_pretrained("mncai/hunminVL_32B_v0.1_20250724")
5
6# 입력 예시: vision + text