Views
No views yet

| File | Type | Description |
|---|---|---|
sd_xl_base_1.0_0_bf16.gguf | BF16 | Best quality, largest size |
sd_xl_base_1.0_0_Q8_0.gguf | Q8_0 | Great balance of quality and size ✅ recommended |
sd_xl_base_1.0_0_Q4_K.gguf | Q4_K | Smaller size, good quality |
sd_xl_base_1.0_0_Q4_0.gguf | Q4_0 | Smallest size |
1# Recommended — Q8_0
2wget https://huggingface.co/kostakoff/stable-diffusion-xl-base-1.0-GGUF/resolve/main/sd_xl_base_1.0_0_Q8_0.gguf
3
4# Other quantizations:
5# wget https://huggingface.co/kostakoff/stable-diffusion-xl-base-1.0-GGUF/resolve/main/sd_xl_base_1.0_0_bf16.gguf
6# wget https://huggingface.co/kostakoff/stable-diffusion-xl-base-1.0-GGUF/resolve/main/sd_xl_base_1.0_0_Q4_K.gguf
7# wget https://huggingface.co/kostakoff/stable-diffusion-xl-base-1.0-GGUF/resolve/main/sd_xl_base_1.0_0_Q4_0.ggufRequirements: CUDA-capable GPU, CMake ≥ 3.18, CUDA Toolkit
1git clone https://github.com/leejet/stable-diffusion.cpp
2cd stable-diffusion.cpp
3git submodule init
4git submodule update
5
6mkdir build && cd build
7cmake .. -DSD_CUDA=ON
8cmake --build . --config Releasestable-diffusion.cpp version master-520-d950627, commit d9506271export CUDA_VISIBLE_DEVICES=0
2
3./stable-diffusion.cpp/build/bin/sd-server \
4 -m ./sd_xl_base_1.0_0_Q8_0.gguf \
5 --vae-on-cpu \
6 --listen-ip 0.0.0.0 \
7 --listen-port 8081⚠️ The--vae-on-cpuflag is required! The VAE decoder consumes up to 10 GB of VRAM when converting the latent representation to PNG. Offloading VAE to CPU makes it possible to run the model on most consumer GPUs.
1curl -s http://127.0.0.1:8081/v1/images/generations \
2 -H "Content-Type: application/json" \
3 -d '{
4 "model": "sdxl",
5 "prompt": "A lovely cat<sd_cpp_extra_args>{\"seed\": 357925}</sd_cpp_extra_args>",
6 "n": 1,
7 "size": "1024x1024",
8 "response_format": "b64_json"
9 }' | jq -r '.data[0].b64_json' | base64 --decode > out.png<sd_cpp_extra_args> as a JSON snippet embedded directly in the prompt field.sd-cli conversion tool:1# Q8_0
2./stable-diffusion.cpp/build/bin/sd-cli -M convert \
3 -m ~/llm/models/sdxl/sd_xl_base_1.0_0.9vae.safetensors \
4 -o ./sd_xl_base_1.0_0_Q8_0.gguf -v --type q8_0
5
6# BF16
7./stable-diffusion.cpp/build/bin/sd-cli -M convert \
8 -m ~/llm/models/sdxl/sd_xl_base_1.0_0.9vae.safetensors \
9 -o ./sd_xl_base_1.0_0_bf16.gguf -v --type bf16
10
11# Q4_0
12./stable-diffusion.cpp/build/bin/sd-cli -M convert \
13 -m ~/llm/models/sdxl/sd_xl_base_1.0_0.9vae.safetensors \
14 -o ./sd_xl_base_1.0_0_Q4_0.gguf -v --type q4_0
15
16# Q4_K
17./stable-diffusion.cpp/build/bin/sd-cli -M convert \
18 -m ~/llm/models/sdxl/sd_xl_base_1.0_0.9vae.safetensors \
19 -o ./sd_xl_base_1.0_0_Q4_K.gguf -v --type q4_K