Views
No views yet
This is a weak model, released for transparency rather than performance. Scored 0.132 standalone on a held-out benchmark whereclaude-haikuscored 0.915 under identical grading. See 한계.
| 항목 | 값 |
|---|---|
| 베이스 모델 | Qwen/Qwen2.5-1.5B |
| 파인튜닝 | QLoRA, r=16, 6 에폭 |
| 학습 데이터 | 자체 작성 QA 45문항 (아래 "학습 데이터" 참고) |
| Training loss | 3.510 → 0.209 |
| 양자화 | Q4_K_M (GGUF), 986MB |
| 서빙 | llama.cpp llama-server (OpenAI 호환 API) |
llama-server로 띄우면 OpenAI 호환 엔드포인트가 열린다.llama-server -m qwen_finetuned_Q4_K_M.gguf --port 8080ChatOpenAI(base_url="http://localhost:8080/v1")로 붙는다
(models.py). 로컬 서버라 API 키는 필요 없다.claude-haiku LLM-as-judge로 전 실험 고정(채점자가 바뀌면
실행 간 비교가 오염되므로).| 구성 | 평균 점수 |
|---|---|
| 이 모델 단독 (Q4) | 0.132 |
| AIsaac 그래프 + 이 모델 (verify도 이 모델) | 0.176 |
| AIsaac 그래프 + 이 모델 (verify는 claude) | 0.445 |
claude-haiku 단독 (참고용 상한) | 0.915 |