mo22323234545 wanghaofan commited on
Commit
c27053a
·
0 Parent(s):

Duplicate from Shakker-Labs/FLUX.1-dev-ControlNet-Union-Pro

Browse files

Co-authored-by: Haofan Wang <wanghaofan@users.noreply.huggingface.co>

.gitattributes ADDED
@@ -0,0 +1,36 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ *.7z filter=lfs diff=lfs merge=lfs -text
2
+ *.arrow filter=lfs diff=lfs merge=lfs -text
3
+ *.bin filter=lfs diff=lfs merge=lfs -text
4
+ *.bz2 filter=lfs diff=lfs merge=lfs -text
5
+ *.ckpt filter=lfs diff=lfs merge=lfs -text
6
+ *.ftz filter=lfs diff=lfs merge=lfs -text
7
+ *.gz filter=lfs diff=lfs merge=lfs -text
8
+ *.h5 filter=lfs diff=lfs merge=lfs -text
9
+ *.joblib filter=lfs diff=lfs merge=lfs -text
10
+ *.lfs.* filter=lfs diff=lfs merge=lfs -text
11
+ *.mlmodel filter=lfs diff=lfs merge=lfs -text
12
+ *.model filter=lfs diff=lfs merge=lfs -text
13
+ *.msgpack filter=lfs diff=lfs merge=lfs -text
14
+ *.npy filter=lfs diff=lfs merge=lfs -text
15
+ *.npz filter=lfs diff=lfs merge=lfs -text
16
+ *.onnx filter=lfs diff=lfs merge=lfs -text
17
+ *.ot filter=lfs diff=lfs merge=lfs -text
18
+ *.parquet filter=lfs diff=lfs merge=lfs -text
19
+ *.pb filter=lfs diff=lfs merge=lfs -text
20
+ *.pickle filter=lfs diff=lfs merge=lfs -text
21
+ *.pkl filter=lfs diff=lfs merge=lfs -text
22
+ *.pt filter=lfs diff=lfs merge=lfs -text
23
+ *.pth filter=lfs diff=lfs merge=lfs -text
24
+ *.rar filter=lfs diff=lfs merge=lfs -text
25
+ *.safetensors filter=lfs diff=lfs merge=lfs -text
26
+ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
27
+ *.tar.* filter=lfs diff=lfs merge=lfs -text
28
+ *.tar filter=lfs diff=lfs merge=lfs -text
29
+ *.tflite filter=lfs diff=lfs merge=lfs -text
30
+ *.tgz filter=lfs diff=lfs merge=lfs -text
31
+ *.wasm filter=lfs diff=lfs merge=lfs -text
32
+ *.xz filter=lfs diff=lfs merge=lfs -text
33
+ *.zip filter=lfs diff=lfs merge=lfs -text
34
+ *.zst filter=lfs diff=lfs merge=lfs -text
35
+ *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ assets/poster.png filter=lfs diff=lfs merge=lfs -text
README.md ADDED
@@ -0,0 +1,111 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: other
3
+ license_name: flux-1-dev-non-commercial-license
4
+ license_link: https://huggingface.co/black-forest-labs/FLUX.1-dev/blob/main/LICENSE.md
5
+
6
+ language:
7
+ - en
8
+ library_name: diffusers
9
+ pipeline_tag: text-to-image
10
+
11
+ tags:
12
+ - Text-to-Image
13
+ - ControlNet
14
+ - Diffusers
15
+ - Flux.1-dev
16
+ - image-generation
17
+ - Stable Diffusion
18
+ base_model: black-forest-labs/FLUX.1-dev
19
+ ---
20
+
21
+ # FLUX.1-dev-ControlNet-Union-Pro
22
+
23
+ This repository contains a unified ControlNet for FLUX.1-dev model jointly released by researchers from [InstantX Team](https://huggingface.co/InstantX) and [Shakker Labs](https://huggingface.co/Shakker-Labs).
24
+
25
+ <div class="container">
26
+ <img src="./assets/poster.png" width="1024"/>
27
+ </div>
28
+
29
+
30
+ # Model Cards
31
+ - This checkpoint is a Pro version of [FLUX.1-dev-Controlnet-Union](https://huggingface.co/InstantX/FLUX.1-dev-Controlnet-Union) trained with more steps and datasets.
32
+ - This model supports 7 control modes, including canny (0), tile (1), depth (2), blur (3), pose (4), gray (5), low quality (6).
33
+ - The recommended controlnet_conditioning_scale is 0.3-0.8.
34
+ - This model can be jointly used with other ControlNets.
35
+
36
+
37
+ # Showcases
38
+
39
+ <div class="container">
40
+ <img src="./assets/teaser1.png" width="1024"/>
41
+ <img src="./assets/teaser2.png" width="1024"/>
42
+ <img src="./assets/teaser3.png" width="1024"/>
43
+ </div>
44
+
45
+
46
+ # Inference
47
+ Please install `diffusers` from [the source](https://github.com/huggingface/diffusers), as [the PR](https://github.com/huggingface/diffusers/pull/9175) has not been included in currently released version yet.
48
+
49
+ # Multi-Controls Inference
50
+ ```python
51
+ import torch
52
+ from diffusers.utils import load_image
53
+
54
+ from diffusers import FluxControlNetPipeline, FluxControlNetModel
55
+ from diffusers.models import FluxMultiControlNetModel
56
+
57
+ base_model = 'black-forest-labs/FLUX.1-dev'
58
+ controlnet_model_union = 'Shakker-Labs/FLUX.1-dev-ControlNet-Union-Pro'
59
+
60
+ controlnet_union = FluxControlNetModel.from_pretrained(controlnet_model_union, torch_dtype=torch.bfloat16)
61
+ controlnet = FluxMultiControlNetModel([controlnet_union]) # we always recommend loading via FluxMultiControlNetModel
62
+
63
+ pipe = FluxControlNetPipeline.from_pretrained(base_model, controlnet=controlnet, torch_dtype=torch.bfloat16)
64
+ pipe.to("cuda")
65
+
66
+ prompt = 'A bohemian-style female travel blogger with sun-kissed skin and messy beach waves.'
67
+ control_image_depth = load_image("https://huggingface.co/Shakker-Labs/FLUX.1-dev-ControlNet-Union-Pro/resolve/main/assets/depth.jpg")
68
+ control_mode_depth = 2
69
+
70
+ control_image_canny = load_image("https://huggingface.co/Shakker-Labs/FLUX.1-dev-ControlNet-Union-Pro/resolve/main/assets/canny.jpg")
71
+ control_mode_canny = 0
72
+
73
+ width, height = control_image_depth.size
74
+
75
+ image = pipe(
76
+ prompt,
77
+ control_image=[control_image_depth, control_image_canny],
78
+ control_mode=[control_mode_depth, control_mode_canny],
79
+ width=width,
80
+ height=height,
81
+ controlnet_conditioning_scale=[0.2, 0.4],
82
+ num_inference_steps=24,
83
+ guidance_scale=3.5,
84
+ generator=torch.manual_seed(42),
85
+ ).images[0]
86
+ ```
87
+
88
+ We also support loading multiple ControlNets as before, you can load as
89
+ ```python
90
+ from diffusers import FluxControlNetModel
91
+ from diffusers.models import FluxMultiControlNetModel
92
+
93
+ controlnet_model_union = 'Shakker-Labs/FLUX.1-dev-ControlNet-Union-Pro'
94
+ controlnet_union = FluxControlNetModel.from_pretrained(controlnet_model_union, torch_dtype=torch.bfloat16)
95
+
96
+ controlnet_model_depth = 'Shakker-Labs/FLUX.1-dev-Controlnet-Depth'
97
+ controlnet_depth = FluxControlNetModel.from_pretrained(controlnet_model_depth, torch_dtype=torch.bfloat16)
98
+
99
+ controlnet = FluxMultiControlNetModel([controlnet_union, controlnet_depth])
100
+
101
+ # set mode to None for other ControlNets
102
+ control_mode=[2, None]
103
+ ```
104
+
105
+ # Resources
106
+ - [InstantX/FLUX.1-dev-Controlnet-Canny](https://huggingface.co/InstantX/FLUX.1-dev-Controlnet-Canny)
107
+ - [Shakker-Labs/FLUX.1-dev-ControlNet-Depth](https://huggingface.co/Shakker-Labs/FLUX.1-dev-ControlNet-Depth)
108
+ - [Shakker-Labs/FLUX.1-dev-ControlNet-Union-Pro](https://huggingface.co/Shakker-Labs/FLUX.1-dev-ControlNet-Union-Pro)
109
+
110
+ # Acknowledgements
111
+ This project is trained by [InstantX Team](https://huggingface.co/InstantX) and sponsored by [Shakker AI](https://www.shakker.ai/). The original idea is inspired by [xinsir/controlnet-union-sdxl-1.0](https://huggingface.co/xinsir/controlnet-union-sdxl-1.0). All copyright reserved.
assets/blur.jpg ADDED
assets/blur_result.jpg ADDED
assets/canny.jpg ADDED
assets/canny_result.jpg ADDED
assets/depth.jpg ADDED
assets/depth_result.jpg ADDED
assets/gray.jpg ADDED
assets/gray_result.jpg ADDED
assets/noise.jpg ADDED
assets/noise_result.jpg ADDED
assets/openpose.jpg ADDED
assets/openpose_result.jpg ADDED
assets/poster.png ADDED

Git LFS Details

  • SHA256: 44d173793f28a123a42addee059fdb058c7ab94af10f7e91009fdc85fc713f59
  • Pointer size: 132 Bytes
  • Size of remote file: 2.56 MB
assets/teaser1.png ADDED
assets/teaser2.png ADDED
assets/teaser3.png ADDED
assets/tile.jpg ADDED
assets/tile_result.jpg ADDED
config.json ADDED
@@ -0,0 +1,19 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_class_name": "FluxControlNetModel",
3
+ "_diffusers_version": "0.30.0.dev0",
4
+ "attention_head_dim": 128,
5
+ "axes_dims_rope": [
6
+ 16,
7
+ 56,
8
+ 56
9
+ ],
10
+ "guidance_embeds": true,
11
+ "in_channels": 64,
12
+ "joint_attention_dim": 4096,
13
+ "num_attention_heads": 24,
14
+ "num_layers": 5,
15
+ "num_mode": 10,
16
+ "num_single_layers": 10,
17
+ "patch_size": 1,
18
+ "pooled_projection_dim": 768
19
+ }
diffusion_pytorch_model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:981a01d6a9575e90820275eda61b33d4ecab0928c68a4f31b132b9687930f90a
3
+ size 6603953920