Views
No views yet
| 項目 | 内容 |
|---|---|
| ベースモデル | Qwen/Qwen2.5-3B |
| 量子化方式 | 1.58bit QAT (Ternary: {-1, 0, +1}) |
| 量子化対象 | 全Linear層 (lm_head・embed_tokensを除く) |
| 学習データ | WikiText-103 (70%) + Wikipedia JA (30%) |
| サンプル数 | 50,000 chunks (512 tokens each) |
| ファインチューン | 2段階 (Stage1: lr=5e-5 / Stage2: lr=5e-6) |
| 最終PPL | 43.92 |
| ファイル | 説明 | サイズ |
|---|---|---|
*.safetensors | HuggingFace形式 (float16) | ~6GB |
qwen25_3b_qat_q4km.gguf | GGUF Q4_K_M量子化版 | ~1.9GB |
1echo 'FROM qwen25_3b_qat_q4km.gguf' > Modelfile
2ollama create qwen25-qat -f Modelfile
3ollama run qwen25-qat