Views
No views yet

| File | Quantization | Description |
|---|---|---|
v1-5-pruned_Q8_0.gguf | Q8_0 | High quality, ~half the size of bf16 |
v1-5-pruned_Q4_K.gguf | Q4_K | Balanced quality/size |
v1-5-pruned_Q4_0.gguf | Q4_0 | Smallest, fastest, slight quality loss |
1wget https://huggingface.co/kostakoff/stable-diffusion-2-GGUF/resolve/main/768-v-ema-Q8_0.gguf
2# Other quantizations:
3# wget https://huggingface.co/kostakoff/stable-diffusion-2-GGUF/resolve/main/768-v-ema-Q4_K.gguf
4# wget https://huggingface.co/kostakoff/stable-diffusion-2-GGUF/resolve/main/768-v-ema-Q4_0.ggufRequirements: CUDA-capable GPU, CMake ≥ 3.18, CUDA Toolkit
1git clone https://github.com/leejet/stable-diffusion.cpp
2cd stable-diffusion.cpp
3git submodule init
4git submodule update
5mkdir build && cd build
6cmake .. -DSD_CUDA=ON
7cmake --build . --config Released950627 (version master-520-d950627). Check your version with:./build/bin/sd-cli --version1export CUDA_VISIBLE_DEVICES=0
2./stable-diffusion.cpp/build/bin/sd-server \
3 -m ./768-v-ema-Q8_0.gguf \
4 --listen-ip 0.0.0.0 \
5 --listen-port 8081 \
6 --seed -1/v1/images/generations endpoint.1curl -s http://127.0.0.1:8081/v1/images/generations \
2 -H "Content-Type: application/json" \
3 -d '{
4 "model": "sd2.0",
5 "prompt": "A lovely cat",
6 "n": 1,
7 "size": "768x768",
8 "response_format": "b64_json"
9 }' | jq -r '.data[0].b64_json' | base64 --decode > output.png<sd_cpp_extra_args> as a JSON snippet embedded directly in the prompt field.sd-cli conversion tool:1# Q4_0
2./stable-diffusion.cpp/build/bin/sd-cli -M convert \
3 -m ~/llm/models/sd2.0/768-v-ema.safetensors \
4 -o 768-v-ema-Q4_0.gguf -v --type q4_0
5# Q4_K
6./stable-diffusion.cpp/build/bin/sd-cli -M convert \
7 -m ~/llm/models/sd2.0/768-v-ema.safetensors \
8 -o ./768-v-ema-Q4_K.gguf -v --type q4_K
9# Q8_0
10./stable-diffusion.cpp/build/bin/sd-cli -M convert \
11 -m ~/llm/models/sd2.0/768-v-ema.safetensors \
12 -o ./768-v-ema-Q8_0.gguf -v --type q8_0