Views
No views yet

| Depth Map | Generated Image 1 | Generated Image 2 |
|---|---|---|
![]() | ![]() | ![]() |
![]() | ![]() | ![]() |
![]() | ![]() | ![]() |
git clone https://github.com/modelscope/DiffSynth-Studio.git
cd DiffSynth-Studio
pip install -e .1from diffsynth.pipelines.qwen_image import QwenImagePipeline, ModelConfig, ControlNetInput
2from PIL import Image
3import torch
4from modelscope import dataset_snapshot_download
5
6
7pipe = QwenImagePipeline.from_pretrained(
8 torch_dtype=torch.bfloat16,
9 device="cuda",
10 model_configs=[
11 ModelConfig(model_id="Qwen/Qwen-Image", origin_file_pattern="transformer/diffusion_pytorch_model*.safetensors"),
12 ModelConfig(model_id="Qwen/Qwen-Image", origin_file_pattern="text_encoder/model*.safetensors"),
13 ModelConfig(model_id="Qwen/Qwen-Image", origin_file_pattern="vae/diffusion_pytorch_model.safetensors"),
14 ModelConfig(model_id="DiffSynth-Studio/Qwen-Image-Blockwise-ControlNet-Depth", origin_file_pattern="model.safetensors"),
15 ],
16 tokenizer_config=ModelConfig(model_id="Qwen/Qwen-Image", origin_file_pattern="tokenizer/"),
17)
18
19dataset_snapshot_download(
20 dataset_id="DiffSynth-Studio/example_image_dataset",
21 local_dir="./data/example_image_dataset",
22 allow_file_pattern="depth/image_1.jpg"
23)
24
25controlnet_image = Image.open("data/example_image_dataset/depth/image_1.jpg").resize((1328, 1328))