-
🖼 멀티모달 지원
이미지 + 텍스트 동시 입력 가능
-
🧩 Thinking 기반 추론 강화
Qwen3-VL-2B-Thinking 아키텍처 기반
-
🇰🇷 한국어 성능 강화
RealQA Evol LoRA를 병합하여
한국어 질의응답/상식/대화 성능 향상
-
🔍 현실 기반 질의응답(RealQA) 성능 향상
-
⚡ GGUF 제공
- F16
- Q4_K_M
- Vision mmproj 포함
→ llama.cpp / LM Studio / OpenWebUI 완전 지원
1from transformers import AutoModelForCausalLM, AutoProcessor
2import torch
3
4model_id = "YOUR_ID/Jinis-vl-2b-ko"
5
6model = AutoModelForCausalLM.from_pretrained(
7 model_id,
8 torch_dtype=torch.bfloat16,
9 device_map="auto"
10)
11
12processor = AutoProcessor.from_pretrained(model_id)
13
14inputs = processor(text="한국어로 자연스럽게 답변해줘.", return_tensors="pt").to("cuda")
15
16out = model.generate(**inputs, max_new_tokens=200)
17print(processor.decode(out[0], skip_special_tokens=True))