Views
No views yet
apt-get update
apt-get install pciutils build-essential cmake curl libcurl4-openssl-dev -y
git clone https://github.com/ggml-org/llama.cpp
cmake llama.cpp -B llama.cpp/build \
-DBUILD_SHARED_LIBS=OFF -DGGML_CUDA=ON
cmake --build llama.cpp/build --config Release -j --clean-first --target llama-cli llama-mtmd-cli llama-server llama-gguf-split
cp llama.cpp/build/bin/llama-* llama.cpp./llama.cpp/llama-cli \
-m huihui-ai/Huihui-Qwable-3.6-27b-abliterated-MTP-GGUF/Huihui-Qwen3.6-27B-abliterated-ggml-model-Q4_K.gguf \
-ngl 99 -c 262144 -fa on -np 1 \
--spec-type draft-mtp --spec-draft-n-max 6| File | Size | out (ffn_down/ssm_out/attn_output) | Everything else |
|---|---|---|---|
Huihui-Qwable-3.6-27b-abliterated-Q4_K_M_Q8.gguf | 19.1 GiB | (ffn_down/ssm_out/attn_output) (Q8_0) | (ffn_gate/ssm_out/ffn_up) (Q4_K), (attn_v/attn_qkv) (Q6_K), MTP(blk.64.) |
Huihui-Qwable-3.6-27b-abliterated-Q4_K_M_F16.gguf | 25.8 GiB | (ffn_down/ssm_out/attn_output) (F16) | (ffn_gate/ssm_out/ffn_up) (Q4_K), (attn_v/attn_qkv) (Q6_K), MTP(blk.64.) |
Huihui-Qwable-3.6-27b-abliterated-F16.gguf | 50.9 GiB | (ffn_down/ssm_out/attn_output) (F16) | (ffn_gate/ssm_out/ffn_up) (F16) , (attn_v/attn_qkv) (F16), MTP(blk.64.) |
bc1qqnkhuchxw0zqjh2ku3lu4hq45hc6gy84uk70ge