Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Qwen3-14b-tunetunning_AWQ – AI Model by aniris | AlphaNeural AI
You can deploy this model and start earning money today!
aniris
/
Qwen3-14b-tunetunning_AWQ
like
0
transformers
safetensors
qwen3
text-generation
chat
awq
korean
conversational
Qwen/Qwen3-14B
quantized
apache-2.0
text-generation-inference
endpoints_compatible
compressed-tensors
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Qwen3-14B Korean Polite-Tone (LoRA + AWQ)
한국어 존댓말 톤과 안전한 응답 스타일에 맞춰 미세 조정한 Qwen3-14B 파생 모델입니다. 소량 ORPO 데이터로 톤만 조절하고, AWQ W4A16으로 추론 비용을 줄인 것이 특징입니다.
Base model
:
Qwen/Qwen3-14B
Task
: Korean chat / assistant (polite style)
Method
: LoRA SFT + AWQ (W4A16)
Artifacts
: merged full model, AWQ-compressed model
Model Description
문제 정의
범용 LLM(Qwen3-14B)은 한국어에서도 강력하지만, 기업 서비스에 바로 쓰기에는
존댓말 일관성 부족
응답 톤의 편차(너무 친근하거나, 과도하게 직설적)
안전/보수적인 응답 스타일 부족 가 문제였습니다.
목표
기존 Qwen3-14B의 지식·추론 능력을 유지
하면서,
320개 수준의 소량 데이터로 한국어 존댓말 톤과 안전한 응답 스타일만 미세 조정
하는 "톤 전용 SFT"를 설계합니다.
운영 환경에서의 비용을 고려해, 최종적으로
AWQ W4A16 양자화로 추론 비용을 줄이되 톤 변화와 응답 품질은 유지
하는 것을 목표로 합니다.