svjack/Stable-Diffusion-FineTuned-zh-v0 is a Chinese-specific latent text-to-image diffusion model capable of generating images given any Chinese text input.
This model was trained by using a powerful text-to-image model,
diffusers
For more information about our training method, see
train_zh_model.py.
With the help of a good baseline model
Taiyi-Stable-Diffusion-1B-Chinese-v0.1 from
IDEA-CCNL
Firstly, install our package as follows. This package is modified
🤗's Diffusers library to run Chinese Stable Diffusion.
1diffusers==0.6.0
2transformers
3torch
4datasets
5accelerate
6sentencepiece
1from diffusers import StableDiffusionPipeline
2pipeline = StableDiffusionPipeline.from_pretrained("svjack/Stable-Diffusion-FineTuned-zh-v2")
3pipeline.safety_checker = lambda images, clip_input: (images, False)
4pipeline = pipeline.to("cuda")
5
6prompt = '女孩们打开了另一世界的大门'
7image = pipeline(prompt, guidance_scale=7.5).images[0]