Views
No views yet
| Quant | Size | Description |
|---|---|---|
| Q4_K_M | 4.7 GB | Balanced quality and size (recommended) |
| Q5_K_M | 5.5 GB | Better quality, slightly larger |
| Q8_0 | 8.2 GB | Highest quality quantization |
./llama-cli -m RemnantInstruct-8B-Q4_K_M.gguf -p "Write a story about..." -n 512ollama run anthonym21/remnantinstruct-8b1slices:
2 - sources:
3 - model: Qwen/Qwen3-8B
4 layer_range: [0, 36]
5 - model: allura-org/remnant-qwen3-8b
6 layer_range: [0, 36]
7merge_method: slerp
8base_model: Qwen/Qwen3-8B
9parameters:
10 t:
11 - filter: self_attn
12 value: [0, 0.5, 0.3, 0.7, 1]
13 - filter: mlp
14 value: [1, 0.5, 0.7, 0.3, 0]
15 - value: 0.5
16dtype: bfloat16