Views
No views yet

| File | Quantization | Description |
|---|---|---|
v1-5-pruned_bf16.gguf | BF16 | Near-lossless, largest file ⚠️ See note below |
v1-5-pruned_Q8_0.gguf | Q8_0 | High quality, ~half the size of bf16 |
v1-5-pruned_Q4_K.gguf | Q4_K | Balanced quality/size |
v1-5-pruned_Q4_0.gguf | Q4_0 | Smallest, fastest, slight quality loss |
⚠️ BF16 known issue: Thebf16variant produces a black image when used with SD 1.5 in stable-diffusion.cpp. This appears to be a bug specific to SD 1.5 — other model architectures are not affected. UseQ8_0if you need maximum quality without quantization loss.
1wget https://huggingface.co/kostakoff/stable-diffusion-v1-5-GGUF/resolve/main/v1-5-pruned_Q4_0.gguf
2
3# Other quantizations:
4# wget https://huggingface.co/kostakoff/stable-diffusion-v1-5-GGUF/resolve/main/v1-5-pruned_Q4_K.gguf
5# wget https://huggingface.co/kostakoff/stable-diffusion-v1-5-GGUF/resolve/main/v1-5-pruned_Q8_0.gguf
6# wget https://huggingface.co/kostakoff/stable-diffusion-v1-5-GGUF/resolve/main/v1-5-pruned_bf16.ggufRequirements: CUDA-capable GPU, CMake ≥ 3.18, CUDA Toolkit
1git clone https://github.com/leejet/stable-diffusion.cpp
2cd stable-diffusion.cpp
3git submodule init
4git submodule update
5mkdir build && cd build
6cmake .. -DSD_CUDA=ON
7cmake --build . --config Released950627 (version master-520-d950627). Check your version with:./build/bin/sd-cli --version1export CUDA_VISIBLE_DEVICES=0
2
3./stable-diffusion.cpp/build/bin/sd-server \
4 -m /path/to/v1-5-pruned_Q4_0.gguf \
5 --vae-on-cpu \
6 --listen-ip 0.0.0.0 \
7 --listen-port 8081/v1/images/generations endpoint.1curl -s http://127.0.0.1:8081/v1/images/generations \
2 -H "Content-Type: application/json" \
3 -d '{
4 "model": "sd",
5 "prompt": "A lovely cat<sd_cpp_extra_args>{\"seed\": 357925}</sd_cpp_extra_args>",
6 "n": 1,
7 "size": "512x512",
8 "response_format": "b64_json"
9 }' | jq -r '.data[0].b64_json' | base64 --decode > output.png<sd_cpp_extra_args> as a JSON snippet embedded directly in the prompt field.1# Q4_0
2./stable-diffusion.cpp/build/bin/sd-cli -M convert \
3 -m ~/llm/models/sd1.5/v1-5-pruned.safetensors \
4 -o v1-5-pruned_Q4_0.gguf -v --type q4_0
5
6# Q4_K
7./stable-diffusion.cpp/build/bin/sd-cli -M convert \
8 -m ~/llm/models/sd1.5/v1-5-pruned.safetensors \
9 -o v1-5-pruned_Q4_K.gguf -v --type q4_K
10
11# Q8_0
12./stable-diffusion.cpp/build/bin/sd-cli -M convert \
13 -m ~/llm/models/sd1.5/v1-5-pruned.safetensors \
14 -o v1-5-pruned_Q8_0.gguf -v --type q8_0
15
16# BF16
17./stable-diffusion.cpp/build/bin/sd-cli -M convert \
18 -m ~/llm/models/sd1.5/v1-5-pruned.safetensors \
19 -o v1-5-pruned_bf16.gguf -v --type bf16