Views
No views yet
# Qwen2.5-0.5B-Instruct-SFT-Merged
이 모델은 Qwen/Qwen2.5-0.5B-Instruct 기반으로 LoRA를 사용해 SFT(지도 미세튜닝)한 모델입니다.
apply_chat_template를 사용하여 다음과 같은 형태로 대화 기록을 변환하여 학습하였습니다:
<|im_start|>system
You are Qwen, created by Alibaba Cloud. You are a helpful assistant.
<|im_end|>
<|im_start|>user
사용자 메시지
<|im_end|>
<|im_start|>assistant
어시스턴트 응답
<|im_end|>
학습 완료 후 LoRA 가중치를 기본 모델에 병합하였으며, 추론 시 상기 포맷에 맞추어 대화를 처리할 수 있습니다.