diff --git a/audio_encoders/put_audio_encoder_models_here b/audio_encoders/put_audio_encoder_models_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/checkpoints/juggernautXL_ragnarokBy.safetensors b/checkpoints/juggernautXL_ragnarokBy.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..b3fc5e9de4f7eefd9ef9b32ee55422510510d2d4 --- /dev/null +++ b/checkpoints/juggernautXL_ragnarokBy.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dd08fa32f98d05a2443ca1419e46df1575a0811f6e3b246d9dd47ff20f5eb66a +size 7105350162 diff --git a/checkpoints/put_checkpoints_here b/checkpoints/put_checkpoints_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/checkpoints/zImageTurbo_turbo.safetensors b/checkpoints/zImageTurbo_turbo.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..7b3ffcac16fc5643fbc96e83f99e02cba071d96b --- /dev/null +++ b/checkpoints/zImageTurbo_turbo.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2407613050b809ffdff18a4ac99af83ea6b95443ecebdf80e064a79c825574a6 +size 12309866400 diff --git a/clip/put_clip_or_text_encoder_models_here b/clip/put_clip_or_text_encoder_models_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/clip/zImageTurbo_textEncoder.safetensors b/clip/zImageTurbo_textEncoder.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..8eb608c38dfe7461d3a72a8c3c1c5db10da90ee0 --- /dev/null +++ b/clip/zImageTurbo_textEncoder.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6c671498573ac2f7a5501502ccce8d2b08ea6ca2f661c458e708f36b36edfc5a +size 8044982048 diff --git a/clip_vision/CLIP-ViT-H-14-laion2B-s32B-b79K.safetensors b/clip_vision/CLIP-ViT-H-14-laion2B-s32B-b79K.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..590c45d8aba49bfa35bc489af660f732aab16568 --- /dev/null +++ b/clip_vision/CLIP-ViT-H-14-laion2B-s32B-b79K.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6ca9667da1ca9e0b0f75e46bb030f7e011f44f86cbfb8d5a36590fcd7507b030 +size 2528373448 diff --git a/clip_vision/CLIP-ViT-bigG-14-laion2B-39B-b160k.safetensors b/clip_vision/CLIP-ViT-bigG-14-laion2B-39B-b160k.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..4e0b50327f653c896fb49fcdb6ab7fd3e56f84b0 --- /dev/null +++ b/clip_vision/CLIP-ViT-bigG-14-laion2B-39B-b160k.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:657723e09f46a7c3957df651601029f66b1748afb12b419816330f16ed45d64d +size 3689912664 diff --git a/clip_vision/clip-vit-large-patch14-336.bin b/clip_vision/clip-vit-large-patch14-336.bin new file mode 100644 index 0000000000000000000000000000000000000000..d599938f87909461098a7856a49c4842c84fc214 --- /dev/null +++ b/clip_vision/clip-vit-large-patch14-336.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c6032c2e0caae3dc2d4fba35535fa6307dbb49df59c7e182b1bc4b3329b81801 +size 1711974081 diff --git a/clip_vision/clip_vision_h.safetensors b/clip_vision/clip_vision_h.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..0451a9fda3873d0db8725fcea14e5660e1793f83 --- /dev/null +++ b/clip_vision/clip_vision_h.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:64a7ef761bfccbadbaa3da77366aac4185a6c58fa5de5f589b42a65bcc21f161 +size 1264219396 diff --git a/clip_vision/clip_vision_vit_h.safetensors b/clip_vision/clip_vision_vit_h.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..590c45d8aba49bfa35bc489af660f732aab16568 --- /dev/null +++ b/clip_vision/clip_vision_vit_h.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6ca9667da1ca9e0b0f75e46bb030f7e011f44f86cbfb8d5a36590fcd7507b030 +size 2528373448 diff --git a/clip_vision/put_clip_vision_models_here b/clip_vision/put_clip_vision_models_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/configs/anything_v3.yaml b/configs/anything_v3.yaml new file mode 100644 index 0000000000000000000000000000000000000000..001d19b9f18fe824124819e3fbc0b76039cfccae --- /dev/null +++ b/configs/anything_v3.yaml @@ -0,0 +1,73 @@ +model: + base_learning_rate: 1.0e-04 + target: ldm.models.diffusion.ddpm.LatentDiffusion + params: + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false # Note: different from the one we trained before + conditioning_key: crossattn + monitor: val/loss_simple_ema + scale_factor: 0.18215 + use_ema: False + + scheduler_config: # 10000 warmup steps + target: ldm.lr_scheduler.LambdaLinearScheduler + params: + warm_up_steps: [ 10000 ] + cycle_lengths: [ 10000000000000 ] # incredibly large number to prevent corner cases + f_start: [ 1.e-6 ] + f_max: [ 1. ] + f_min: [ 1. ] + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + image_size: 32 # unused + in_channels: 4 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_heads: 8 + use_spatial_transformer: True + transformer_depth: 1 + context_dim: 768 + use_checkpoint: True + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenCLIPEmbedder + params: + layer: "hidden" + layer_idx: -2 diff --git a/configs/v1-inference.yaml b/configs/v1-inference.yaml new file mode 100644 index 0000000000000000000000000000000000000000..9e1fcee603d737c2510707e42c30b368d516d692 --- /dev/null +++ b/configs/v1-inference.yaml @@ -0,0 +1,70 @@ +model: + base_learning_rate: 1.0e-04 + target: ldm.models.diffusion.ddpm.LatentDiffusion + params: + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false # Note: different from the one we trained before + conditioning_key: crossattn + monitor: val/loss_simple_ema + scale_factor: 0.18215 + use_ema: False + + scheduler_config: # 10000 warmup steps + target: ldm.lr_scheduler.LambdaLinearScheduler + params: + warm_up_steps: [ 10000 ] + cycle_lengths: [ 10000000000000 ] # incredibly large number to prevent corner cases + f_start: [ 1.e-6 ] + f_max: [ 1. ] + f_min: [ 1. ] + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + image_size: 32 # unused + in_channels: 4 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_heads: 8 + use_spatial_transformer: True + transformer_depth: 1 + context_dim: 768 + use_checkpoint: True + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenCLIPEmbedder diff --git a/configs/v1-inference_clip_skip_2.yaml b/configs/v1-inference_clip_skip_2.yaml new file mode 100644 index 0000000000000000000000000000000000000000..001d19b9f18fe824124819e3fbc0b76039cfccae --- /dev/null +++ b/configs/v1-inference_clip_skip_2.yaml @@ -0,0 +1,73 @@ +model: + base_learning_rate: 1.0e-04 + target: ldm.models.diffusion.ddpm.LatentDiffusion + params: + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false # Note: different from the one we trained before + conditioning_key: crossattn + monitor: val/loss_simple_ema + scale_factor: 0.18215 + use_ema: False + + scheduler_config: # 10000 warmup steps + target: ldm.lr_scheduler.LambdaLinearScheduler + params: + warm_up_steps: [ 10000 ] + cycle_lengths: [ 10000000000000 ] # incredibly large number to prevent corner cases + f_start: [ 1.e-6 ] + f_max: [ 1. ] + f_min: [ 1. ] + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + image_size: 32 # unused + in_channels: 4 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_heads: 8 + use_spatial_transformer: True + transformer_depth: 1 + context_dim: 768 + use_checkpoint: True + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenCLIPEmbedder + params: + layer: "hidden" + layer_idx: -2 diff --git a/configs/v1-inference_clip_skip_2_fp16.yaml b/configs/v1-inference_clip_skip_2_fp16.yaml new file mode 100644 index 0000000000000000000000000000000000000000..29e92938b4e6ab7b34b2461b76b55eef80416c7b --- /dev/null +++ b/configs/v1-inference_clip_skip_2_fp16.yaml @@ -0,0 +1,74 @@ +model: + base_learning_rate: 1.0e-04 + target: ldm.models.diffusion.ddpm.LatentDiffusion + params: + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false # Note: different from the one we trained before + conditioning_key: crossattn + monitor: val/loss_simple_ema + scale_factor: 0.18215 + use_ema: False + + scheduler_config: # 10000 warmup steps + target: ldm.lr_scheduler.LambdaLinearScheduler + params: + warm_up_steps: [ 10000 ] + cycle_lengths: [ 10000000000000 ] # incredibly large number to prevent corner cases + f_start: [ 1.e-6 ] + f_max: [ 1. ] + f_min: [ 1. ] + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + use_fp16: True + image_size: 32 # unused + in_channels: 4 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_heads: 8 + use_spatial_transformer: True + transformer_depth: 1 + context_dim: 768 + use_checkpoint: True + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenCLIPEmbedder + params: + layer: "hidden" + layer_idx: -2 diff --git a/configs/v1-inference_fp16.yaml b/configs/v1-inference_fp16.yaml new file mode 100644 index 0000000000000000000000000000000000000000..a3e9b778c95c06867ca670f2dbd8eb1bbb449251 --- /dev/null +++ b/configs/v1-inference_fp16.yaml @@ -0,0 +1,71 @@ +model: + base_learning_rate: 1.0e-04 + target: ldm.models.diffusion.ddpm.LatentDiffusion + params: + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false # Note: different from the one we trained before + conditioning_key: crossattn + monitor: val/loss_simple_ema + scale_factor: 0.18215 + use_ema: False + + scheduler_config: # 10000 warmup steps + target: ldm.lr_scheduler.LambdaLinearScheduler + params: + warm_up_steps: [ 10000 ] + cycle_lengths: [ 10000000000000 ] # incredibly large number to prevent corner cases + f_start: [ 1.e-6 ] + f_max: [ 1. ] + f_min: [ 1. ] + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + use_fp16: True + image_size: 32 # unused + in_channels: 4 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_heads: 8 + use_spatial_transformer: True + transformer_depth: 1 + context_dim: 768 + use_checkpoint: True + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenCLIPEmbedder diff --git a/configs/v1-inpainting-inference.yaml b/configs/v1-inpainting-inference.yaml new file mode 100644 index 0000000000000000000000000000000000000000..f50926ce155e50a3012921018215426c518d6137 --- /dev/null +++ b/configs/v1-inpainting-inference.yaml @@ -0,0 +1,71 @@ +model: + base_learning_rate: 7.5e-05 + target: ldm.models.diffusion.ddpm.LatentInpaintDiffusion + params: + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false # Note: different from the one we trained before + conditioning_key: hybrid # important + monitor: val/loss_simple_ema + scale_factor: 0.18215 + finetune_keys: null + + scheduler_config: # 10000 warmup steps + target: ldm.lr_scheduler.LambdaLinearScheduler + params: + warm_up_steps: [ 2500 ] # NOTE for resuming. use 10000 if starting from scratch + cycle_lengths: [ 10000000000000 ] # incredibly large number to prevent corner cases + f_start: [ 1.e-6 ] + f_max: [ 1. ] + f_min: [ 1. ] + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + image_size: 32 # unused + in_channels: 9 # 4 data + 4 downscaled image + 1 mask + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_heads: 8 + use_spatial_transformer: True + transformer_depth: 1 + context_dim: 768 + use_checkpoint: True + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenCLIPEmbedder + diff --git a/configs/v2-inference-v.yaml b/configs/v2-inference-v.yaml new file mode 100644 index 0000000000000000000000000000000000000000..a2192245b1b93c59fdbfac71a9d636aa91b156e5 --- /dev/null +++ b/configs/v2-inference-v.yaml @@ -0,0 +1,68 @@ +model: + base_learning_rate: 1.0e-4 + target: ldm.models.diffusion.ddpm.LatentDiffusion + params: + parameterization: "v" + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false + conditioning_key: crossattn + monitor: val/loss_simple_ema + scale_factor: 0.18215 + use_ema: False # we set this to false because this is an inference only config + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + use_checkpoint: True + use_fp16: True + image_size: 32 # unused + in_channels: 4 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_head_channels: 64 # need to fix for flash-attn + use_spatial_transformer: True + use_linear_in_transformer: True + transformer_depth: 1 + context_dim: 1024 + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + #attn_type: "vanilla-xformers" + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenOpenCLIPEmbedder + params: + freeze: True + layer: "penultimate" diff --git a/configs/v2-inference-v_fp32.yaml b/configs/v2-inference-v_fp32.yaml new file mode 100644 index 0000000000000000000000000000000000000000..b4cb8c6ec6cfedc94233e5807ded7e6541fc555b --- /dev/null +++ b/configs/v2-inference-v_fp32.yaml @@ -0,0 +1,68 @@ +model: + base_learning_rate: 1.0e-4 + target: ldm.models.diffusion.ddpm.LatentDiffusion + params: + parameterization: "v" + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false + conditioning_key: crossattn + monitor: val/loss_simple_ema + scale_factor: 0.18215 + use_ema: False # we set this to false because this is an inference only config + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + use_checkpoint: True + use_fp16: False + image_size: 32 # unused + in_channels: 4 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_head_channels: 64 # need to fix for flash-attn + use_spatial_transformer: True + use_linear_in_transformer: True + transformer_depth: 1 + context_dim: 1024 + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + #attn_type: "vanilla-xformers" + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenOpenCLIPEmbedder + params: + freeze: True + layer: "penultimate" diff --git a/configs/v2-inference.yaml b/configs/v2-inference.yaml new file mode 100644 index 0000000000000000000000000000000000000000..73ea4cabce39e54340ed99ffb49269a647eae31d --- /dev/null +++ b/configs/v2-inference.yaml @@ -0,0 +1,67 @@ +model: + base_learning_rate: 1.0e-4 + target: ldm.models.diffusion.ddpm.LatentDiffusion + params: + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false + conditioning_key: crossattn + monitor: val/loss_simple_ema + scale_factor: 0.18215 + use_ema: False # we set this to false because this is an inference only config + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + use_checkpoint: True + use_fp16: True + image_size: 32 # unused + in_channels: 4 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_head_channels: 64 # need to fix for flash-attn + use_spatial_transformer: True + use_linear_in_transformer: True + transformer_depth: 1 + context_dim: 1024 + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + #attn_type: "vanilla-xformers" + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenOpenCLIPEmbedder + params: + freeze: True + layer: "penultimate" diff --git a/configs/v2-inference_fp32.yaml b/configs/v2-inference_fp32.yaml new file mode 100644 index 0000000000000000000000000000000000000000..4eb0d712a9c209dc10e8f15b7af2324e0a3889d9 --- /dev/null +++ b/configs/v2-inference_fp32.yaml @@ -0,0 +1,67 @@ +model: + base_learning_rate: 1.0e-4 + target: ldm.models.diffusion.ddpm.LatentDiffusion + params: + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false + conditioning_key: crossattn + monitor: val/loss_simple_ema + scale_factor: 0.18215 + use_ema: False # we set this to false because this is an inference only config + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + use_checkpoint: True + use_fp16: False + image_size: 32 # unused + in_channels: 4 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_head_channels: 64 # need to fix for flash-attn + use_spatial_transformer: True + use_linear_in_transformer: True + transformer_depth: 1 + context_dim: 1024 + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + #attn_type: "vanilla-xformers" + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenOpenCLIPEmbedder + params: + freeze: True + layer: "penultimate" diff --git a/configs/v2-inpainting-inference.yaml b/configs/v2-inpainting-inference.yaml new file mode 100644 index 0000000000000000000000000000000000000000..0798285b2b392dab68bb394bbf18fab2fe07587f --- /dev/null +++ b/configs/v2-inpainting-inference.yaml @@ -0,0 +1,158 @@ +model: + base_learning_rate: 5.0e-05 + target: ldm.models.diffusion.ddpm.LatentInpaintDiffusion + params: + linear_start: 0.00085 + linear_end: 0.0120 + num_timesteps_cond: 1 + log_every_t: 200 + timesteps: 1000 + first_stage_key: "jpg" + cond_stage_key: "txt" + image_size: 64 + channels: 4 + cond_stage_trainable: false + conditioning_key: hybrid + scale_factor: 0.18215 + monitor: val/loss_simple_ema + finetune_keys: null + use_ema: False + + unet_config: + target: ldm.modules.diffusionmodules.openaimodel.UNetModel + params: + use_checkpoint: True + image_size: 32 # unused + in_channels: 9 + out_channels: 4 + model_channels: 320 + attention_resolutions: [ 4, 2, 1 ] + num_res_blocks: 2 + channel_mult: [ 1, 2, 4, 4 ] + num_head_channels: 64 # need to fix for flash-attn + use_spatial_transformer: True + use_linear_in_transformer: True + transformer_depth: 1 + context_dim: 1024 + legacy: False + + first_stage_config: + target: ldm.models.autoencoder.AutoencoderKL + params: + embed_dim: 4 + monitor: val/rec_loss + ddconfig: + #attn_type: "vanilla-xformers" + double_z: true + z_channels: 4 + resolution: 256 + in_channels: 3 + out_ch: 3 + ch: 128 + ch_mult: + - 1 + - 2 + - 4 + - 4 + num_res_blocks: 2 + attn_resolutions: [ ] + dropout: 0.0 + lossconfig: + target: torch.nn.Identity + + cond_stage_config: + target: ldm.modules.encoders.modules.FrozenOpenCLIPEmbedder + params: + freeze: True + layer: "penultimate" + + +data: + target: ldm.data.laion.WebDataModuleFromConfig + params: + tar_base: null # for concat as in LAION-A + p_unsafe_threshold: 0.1 + filter_word_list: "data/filters.yaml" + max_pwatermark: 0.45 + batch_size: 8 + num_workers: 6 + multinode: True + min_size: 512 + train: + shards: + - "pipe:aws s3 cp s3://stability-aws/laion-a-native/part-0/{00000..18699}.tar -" + - "pipe:aws s3 cp s3://stability-aws/laion-a-native/part-1/{00000..18699}.tar -" + - "pipe:aws s3 cp s3://stability-aws/laion-a-native/part-2/{00000..18699}.tar -" + - "pipe:aws s3 cp s3://stability-aws/laion-a-native/part-3/{00000..18699}.tar -" + - "pipe:aws s3 cp s3://stability-aws/laion-a-native/part-4/{00000..18699}.tar -" #{00000-94333}.tar" + shuffle: 10000 + image_key: jpg + image_transforms: + - target: torchvision.transforms.Resize + params: + size: 512 + interpolation: 3 + - target: torchvision.transforms.RandomCrop + params: + size: 512 + postprocess: + target: ldm.data.laion.AddMask + params: + mode: "512train-large" + p_drop: 0.25 + # NOTE use enough shards to avoid empty validation loops in workers + validation: + shards: + - "pipe:aws s3 cp s3://deep-floyd-s3/datasets/laion_cleaned-part5/{93001..94333}.tar - " + shuffle: 0 + image_key: jpg + image_transforms: + - target: torchvision.transforms.Resize + params: + size: 512 + interpolation: 3 + - target: torchvision.transforms.CenterCrop + params: + size: 512 + postprocess: + target: ldm.data.laion.AddMask + params: + mode: "512train-large" + p_drop: 0.25 + +lightning: + find_unused_parameters: True + modelcheckpoint: + params: + every_n_train_steps: 5000 + + callbacks: + metrics_over_trainsteps_checkpoint: + params: + every_n_train_steps: 10000 + + image_logger: + target: main.ImageLogger + params: + enable_autocast: False + disabled: False + batch_frequency: 1000 + max_images: 4 + increase_log_steps: False + log_first_step: False + log_images_kwargs: + use_ema_scope: False + inpaint: False + plot_progressive_rows: False + plot_diffusion_rows: False + N: 4 + unconditional_guidance_scale: 5.0 + unconditional_guidance_label: [""] + ddim_steps: 50 # todo check these out for depth2img, + ddim_eta: 0.0 # todo check these out for depth2img, + + trainer: + benchmark: True + val_check_interval: 5000000 + num_sanity_val_steps: 0 + accumulate_grad_batches: 1 diff --git a/controlnet/SD1.5/t2iadapter_openpose_sd14v1.pth b/controlnet/SD1.5/t2iadapter_openpose_sd14v1.pth new file mode 100644 index 0000000000000000000000000000000000000000..316f6c509865e713899078c757c07e19a1183595 --- /dev/null +++ b/controlnet/SD1.5/t2iadapter_openpose_sd14v1.pth @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f8d8027cbeae188dcae57b7475243b7dec20f2620c3c0fe7778319c56bf1ec6b +size 309487667 diff --git a/controlnet/instantid/diffusion_pytorch_model.safetensors b/controlnet/instantid/diffusion_pytorch_model.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..610fcb2cc99d3414c88fc2de4d75cc594dd48b07 --- /dev/null +++ b/controlnet/instantid/diffusion_pytorch_model.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c8127be9f174101ebdafee9964d856b49b634435cf6daa396d3f593cf0bbbb05 +size 2502139136 diff --git a/controlnet/put_controlnets_and_t2i_here b/controlnet/put_controlnets_and_t2i_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/diffusers/put_diffusers_models_here b/diffusers/put_diffusers_models_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/diffusion_models/Wan2_2-I2V-A14B-HIGH_fp8_e4m3fn_scaled_KJ.safetensors b/diffusion_models/Wan2_2-I2V-A14B-HIGH_fp8_e4m3fn_scaled_KJ.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..f012f6f2d07350be55fc0ae1e38da512938cc70a --- /dev/null +++ b/diffusion_models/Wan2_2-I2V-A14B-HIGH_fp8_e4m3fn_scaled_KJ.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b3a6e732feb5fd5fa35f5e3ef612fa1f0a77dc66601fbf999d4f84a01e7120a6 +size 15002999858 diff --git a/diffusion_models/Wan2_2-I2V-A14B-LOW_fp8_e4m3fn_scaled_KJ.safetensors b/diffusion_models/Wan2_2-I2V-A14B-LOW_fp8_e4m3fn_scaled_KJ.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..cfd9ae57460bc58c304decc712a4a547f7dedf0e --- /dev/null +++ b/diffusion_models/Wan2_2-I2V-A14B-LOW_fp8_e4m3fn_scaled_KJ.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3338c9e672ad9e406a28b38231d6c9d94bf63ab73c3940b91428321993491bb8 +size 15002999858 diff --git a/diffusion_models/put_diffusion_model_files_here b/diffusion_models/put_diffusion_model_files_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/embeddings/put_embeddings_or_textual_inversion_concepts_here b/embeddings/put_embeddings_or_textual_inversion_concepts_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/facedetection/detection_Resnet50_Final.pth b/facedetection/detection_Resnet50_Final.pth new file mode 100644 index 0000000000000000000000000000000000000000..16546738ce0a00a9fd47585e0fc52744d31cc117 --- /dev/null +++ b/facedetection/detection_Resnet50_Final.pth @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6d1de9c2944f2ccddca5f5e010ea5ae64a39845a86311af6fdf30841b0a5a16d +size 109497761 diff --git a/facedetection/parsing_parsenet.pth b/facedetection/parsing_parsenet.pth new file mode 100644 index 0000000000000000000000000000000000000000..1ac2efc50360a79c9905dbac57d9d99cbfbe863c --- /dev/null +++ b/facedetection/parsing_parsenet.pth @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3d558d8d0e42c20224f13cf5a29c79eba2d59913419f945545d8cf7b72920de2 +size 85331193 diff --git a/facerestore_models/GFPGANv1.3.pth b/facerestore_models/GFPGANv1.3.pth new file mode 100644 index 0000000000000000000000000000000000000000..1da748a3ef84ff85dd2c77c836f222aae22b007e --- /dev/null +++ b/facerestore_models/GFPGANv1.3.pth @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c953a88f2727c85c3d9ae72e2bd4846bbaf59fe6972ad94130e23e7017524a70 +size 348632874 diff --git a/facerestore_models/GFPGANv1.4.pth b/facerestore_models/GFPGANv1.4.pth new file mode 100644 index 0000000000000000000000000000000000000000..afedb5c7e826056840c9cc183f2c6f0186fd17ba --- /dev/null +++ b/facerestore_models/GFPGANv1.4.pth @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e2cd4703ab14f4d01fd1383a8a8b266f9a5833dacee8e6a79d3bf21a1b6be5ad +size 348632874 diff --git a/facerestore_models/GPEN-BFR-512.onnx b/facerestore_models/GPEN-BFR-512.onnx new file mode 100644 index 0000000000000000000000000000000000000000..d2111b516504e5ae7bcaeee49192bcac9ca52690 --- /dev/null +++ b/facerestore_models/GPEN-BFR-512.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bf80acb8e91ba8852e3f012505be2c3b6cd6b3eed5ec605e3db87863c4e74d4e +size 284244491 diff --git a/facerestore_models/codeformer-v0.1.0.pth b/facerestore_models/codeformer-v0.1.0.pth new file mode 100644 index 0000000000000000000000000000000000000000..edd450da13c5ff890f70d726c992af569813f6af --- /dev/null +++ b/facerestore_models/codeformer-v0.1.0.pth @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1009e537e0c2a07d4cabce6355f53cb66767cd4b4297ec7a4a64ca4b8a5684b7 +size 376637898 diff --git a/gligen/put_gligen_models_here b/gligen/put_gligen_models_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/hypernetworks/put_hypernetworks_here b/hypernetworks/put_hypernetworks_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/insightface/inswapper_128.onnx b/insightface/inswapper_128.onnx new file mode 100644 index 0000000000000000000000000000000000000000..cb672b799d74fdf7ab8b172a1b1d78411f6400f5 --- /dev/null +++ b/insightface/inswapper_128.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e4a3f08c753cb72d04e10aa0f7dbe3deebbf39567d4ead6dce08e98aa49e16af +size 554253681 diff --git a/insightface/models/antelopev2.zip b/insightface/models/antelopev2.zip new file mode 100644 index 0000000000000000000000000000000000000000..b940dc7e26eb5353e5d5722d4cec3d513cffb0d3 --- /dev/null +++ b/insightface/models/antelopev2.zip @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8e182f14fc6e80b3bfa375b33eb6cff7ee05d8ef7633e738d1c89021dcf0c5c5 +size 360662982 diff --git a/insightface/models/antelopev2/1k3d68.onnx b/insightface/models/antelopev2/1k3d68.onnx new file mode 100644 index 0000000000000000000000000000000000000000..221aa2f02a6faccddb2723529e1f93c7db2edbdc --- /dev/null +++ b/insightface/models/antelopev2/1k3d68.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:df5c06b8a0c12e422b2ed8947b8869faa4105387f199c477af038aa01f9a45cc +size 143607619 diff --git a/insightface/models/antelopev2/2d106det.onnx b/insightface/models/antelopev2/2d106det.onnx new file mode 100644 index 0000000000000000000000000000000000000000..cdb163d88b5f51396855ebc795e0114322c98b6b --- /dev/null +++ b/insightface/models/antelopev2/2d106det.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f001b856447c413801ef5c42091ed0cd516fcd21f2d6b79635b1e733a7109dbf +size 5030888 diff --git a/insightface/models/antelopev2/genderage.onnx b/insightface/models/antelopev2/genderage.onnx new file mode 100644 index 0000000000000000000000000000000000000000..fcf638481cea978e99ddabd914ccd3b70c8401cb --- /dev/null +++ b/insightface/models/antelopev2/genderage.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4fde69b1c810857b88c64a335084f1c3fe8f01246c9a191b48c7bb756d6652fb +size 1322532 diff --git a/insightface/models/antelopev2/glintr100.onnx b/insightface/models/antelopev2/glintr100.onnx new file mode 100644 index 0000000000000000000000000000000000000000..9d221846df998a9c85239fd74a9fe5685193775f --- /dev/null +++ b/insightface/models/antelopev2/glintr100.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4ab1d6435d639628a6f3e5008dd4f929edf4c4124b1a7169e1048f9fef534cdf +size 260665334 diff --git a/insightface/models/antelopev2/scrfd_10g_bnkps.onnx b/insightface/models/antelopev2/scrfd_10g_bnkps.onnx new file mode 100644 index 0000000000000000000000000000000000000000..aa586e034379fa5ea5babc8aa73d47afcd0fa6c2 --- /dev/null +++ b/insightface/models/antelopev2/scrfd_10g_bnkps.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5838f7fe053675b1c7a08b633df49e7af5495cee0493c7dcf6697200b85b5b91 +size 16923827 diff --git a/insightface/models/buffalo_l/1k3d68.onnx b/insightface/models/buffalo_l/1k3d68.onnx new file mode 100644 index 0000000000000000000000000000000000000000..221aa2f02a6faccddb2723529e1f93c7db2edbdc --- /dev/null +++ b/insightface/models/buffalo_l/1k3d68.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:df5c06b8a0c12e422b2ed8947b8869faa4105387f199c477af038aa01f9a45cc +size 143607619 diff --git a/insightface/models/buffalo_l/2d106det.onnx b/insightface/models/buffalo_l/2d106det.onnx new file mode 100644 index 0000000000000000000000000000000000000000..cdb163d88b5f51396855ebc795e0114322c98b6b --- /dev/null +++ b/insightface/models/buffalo_l/2d106det.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f001b856447c413801ef5c42091ed0cd516fcd21f2d6b79635b1e733a7109dbf +size 5030888 diff --git a/insightface/models/buffalo_l/det_10g.onnx b/insightface/models/buffalo_l/det_10g.onnx new file mode 100644 index 0000000000000000000000000000000000000000..aa586e034379fa5ea5babc8aa73d47afcd0fa6c2 --- /dev/null +++ b/insightface/models/buffalo_l/det_10g.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5838f7fe053675b1c7a08b633df49e7af5495cee0493c7dcf6697200b85b5b91 +size 16923827 diff --git a/insightface/models/buffalo_l/genderage.onnx b/insightface/models/buffalo_l/genderage.onnx new file mode 100644 index 0000000000000000000000000000000000000000..fcf638481cea978e99ddabd914ccd3b70c8401cb --- /dev/null +++ b/insightface/models/buffalo_l/genderage.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4fde69b1c810857b88c64a335084f1c3fe8f01246c9a191b48c7bb756d6652fb +size 1322532 diff --git a/insightface/models/buffalo_l/w600k_r50.onnx b/insightface/models/buffalo_l/w600k_r50.onnx new file mode 100644 index 0000000000000000000000000000000000000000..571d2bb9ffd76399b23260620b9101b20bcc4e99 --- /dev/null +++ b/insightface/models/buffalo_l/w600k_r50.onnx @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4c06341c33c2ca1f86781dab0e829f88ad5b64be9fba56e56bc9ebdefc619e43 +size 174383860 diff --git a/instantid/SDXL/ip-adapter.bin b/instantid/SDXL/ip-adapter.bin new file mode 100644 index 0000000000000000000000000000000000000000..55c98e90c7047768538ad83e8f06f44c017fc329 --- /dev/null +++ b/instantid/SDXL/ip-adapter.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:02b3618e36d803784166660520098089a81388e61a93ef8002aa79a5b1c546e1 +size 1691134141 diff --git a/instantid/instantid_face_adapter.bin b/instantid/instantid_face_adapter.bin new file mode 100644 index 0000000000000000000000000000000000000000..55c98e90c7047768538ad83e8f06f44c017fc329 --- /dev/null +++ b/instantid/instantid_face_adapter.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:02b3618e36d803784166660520098089a81388e61a93ef8002aa79a5b1c546e1 +size 1691134141 diff --git a/ipadapter-flux/ip-adapter.bin b/ipadapter-flux/ip-adapter.bin new file mode 100644 index 0000000000000000000000000000000000000000..750d1a6fca586dfd29e68825b6ef606678a53faf --- /dev/null +++ b/ipadapter-flux/ip-adapter.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:01aaeb0dace9ea4feee1007d30e41c59847041c116db8c2bcc14f9c91d491203 +size 5291249450 diff --git a/ipadapter/Kolors-IP-Adapter-FaceID-Plus.bin b/ipadapter/Kolors-IP-Adapter-FaceID-Plus.bin new file mode 100644 index 0000000000000000000000000000000000000000..ebe96694a3b2cfa9de149fcc7d5f96416512ae21 --- /dev/null +++ b/ipadapter/Kolors-IP-Adapter-FaceID-Plus.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8af246ef794e17523e83723b8d84be598c69d78241d943f3c50e6ca263389fd8 +size 2385842603 diff --git a/ipadapter/Kolors-IP-Adapter-Plus.bin b/ipadapter/Kolors-IP-Adapter-Plus.bin new file mode 100644 index 0000000000000000000000000000000000000000..e3c5b658c049440cd3d1454a0934ecce43005fec --- /dev/null +++ b/ipadapter/Kolors-IP-Adapter-Plus.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1983c3f927acb2a2f4285e1e134f302fab8e6d744a3b058e46848aba9957a60f +size 1013163359 diff --git a/ipadapter/instantid_face_adapter.bin b/ipadapter/instantid_face_adapter.bin new file mode 100644 index 0000000000000000000000000000000000000000..55c98e90c7047768538ad83e8f06f44c017fc329 --- /dev/null +++ b/ipadapter/instantid_face_adapter.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:02b3618e36d803784166660520098089a81388e61a93ef8002aa79a5b1c546e1 +size 1691134141 diff --git a/ipadapter/ip-adapter-faceid-plus_sd15.bin b/ipadapter/ip-adapter-faceid-plus_sd15.bin new file mode 100644 index 0000000000000000000000000000000000000000..57e1d0254a2f24d060f890d34e233e9feef685d1 --- /dev/null +++ b/ipadapter/ip-adapter-faceid-plus_sd15.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:252fb53e0d018489d9e7f9b9e2001a52ff700e491894011ada7cfb471e0fadf2 +size 156558503 diff --git a/ipadapter/ip-adapter-faceid-plusv2_sd15.bin b/ipadapter/ip-adapter-faceid-plusv2_sd15.bin new file mode 100644 index 0000000000000000000000000000000000000000..2b83b06efc1d0f8bc11c2aecdb1932d7c80faefa --- /dev/null +++ b/ipadapter/ip-adapter-faceid-plusv2_sd15.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:26d0d86a1d60d6cc811d3b8862178b461e1eeb651e6fe2b72ba17aa95411e313 +size 156558509 diff --git a/ipadapter/ip-adapter-faceid-plusv2_sdxl.bin b/ipadapter/ip-adapter-faceid-plusv2_sdxl.bin new file mode 100644 index 0000000000000000000000000000000000000000..03a96ac98b0838885cb298c8abb053c301a20f6b --- /dev/null +++ b/ipadapter/ip-adapter-faceid-plusv2_sdxl.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c6945d82b543700cc3ccbb98d363b837e9c596281607857c74b713a876daf5fb +size 1487555181 diff --git a/ipadapter/ip-adapter-faceid-portrait-v11_sd15.bin b/ipadapter/ip-adapter-faceid-portrait-v11_sd15.bin new file mode 100644 index 0000000000000000000000000000000000000000..f7a0aaef6324beb4aed57588326c828849b2fac0 --- /dev/null +++ b/ipadapter/ip-adapter-faceid-portrait-v11_sd15.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a48cb4f89ed18e02c6000f65aa9efec452e87eaed4a1bc9fcf4a460c8d0e3bc6 +size 64586623 diff --git a/ipadapter/ip-adapter-faceid-portrait_sd15.bin b/ipadapter/ip-adapter-faceid-portrait_sd15.bin new file mode 100644 index 0000000000000000000000000000000000000000..c815d258a84702d84cf9007d0712ca50a9140976 --- /dev/null +++ b/ipadapter/ip-adapter-faceid-portrait_sd15.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:68570f3c14fe125b00d4abf416af33d8b13bb496f4e55af2eb5d0a6017ee99a4 +size 64586611 diff --git a/ipadapter/ip-adapter-faceid-portrait_sdxl.bin b/ipadapter/ip-adapter-faceid-portrait_sdxl.bin new file mode 100644 index 0000000000000000000000000000000000000000..056c4c41c6b0d4d89589f56489f4786a8b8c99b5 --- /dev/null +++ b/ipadapter/ip-adapter-faceid-portrait_sdxl.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5631ce7824cdafd2db37c5e85b985730a95ff59c5b4fc80c2b79b0bee5711512 +size 749822515 diff --git a/ipadapter/ip-adapter-faceid-portrait_sdxl_unnorm.bin b/ipadapter/ip-adapter-faceid-portrait_sdxl_unnorm.bin new file mode 100644 index 0000000000000000000000000000000000000000..fef531fa8dba6d532b2249bad7f2894e77175f44 --- /dev/null +++ b/ipadapter/ip-adapter-faceid-portrait_sdxl_unnorm.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:220bb86e205393a3d0411631cb473caddbf35fd371be2905ca9008818170db55 +size 1009523411 diff --git a/ipadapter/ip-adapter-faceid_sd15.bin b/ipadapter/ip-adapter-faceid_sd15.bin new file mode 100644 index 0000000000000000000000000000000000000000..95b32b7455efc1aef93dc4b3d162b6e0b7bc8a8e --- /dev/null +++ b/ipadapter/ip-adapter-faceid_sd15.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:201344e22e6f55849cf07ca7a6e53d8c3b001327c66cb9710d69fd5da48a8da7 +size 96740574 diff --git a/ipadapter/ip-adapter-faceid_sdxl.bin b/ipadapter/ip-adapter-faceid_sdxl.bin new file mode 100644 index 0000000000000000000000000000000000000000..712152f4624a8b236ae6f292e9444619aef1382d --- /dev/null +++ b/ipadapter/ip-adapter-faceid_sdxl.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f455fed24e207c878ec1e0466b34a969d37bab857c5faa4e8d259a0b4ff63d7e +size 1071149741 diff --git a/ipadapter/ip-adapter-full-face_sd15.safetensors b/ipadapter/ip-adapter-full-face_sd15.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..53e15c464d79ac549dd16d9de42cdf76bda84e66 --- /dev/null +++ b/ipadapter/ip-adapter-full-face_sd15.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f4a17fb643bf876235a45a0e87a49da2855be6584b28ca04c62a97ab5ff1c6f3 +size 43592352 diff --git a/ipadapter/ip-adapter-plus-face_sd15.safetensors b/ipadapter/ip-adapter-plus-face_sd15.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..767025ddb47fe89baa927b8c2eee8fe99a1f6edb --- /dev/null +++ b/ipadapter/ip-adapter-plus-face_sd15.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1c9edc21af6f737dc1d6e0e734190e976cfacf802d6b024b77aa3be922f7569b +size 98183288 diff --git a/ipadapter/ip-adapter-plus-face_sdxl_vit-h.safetensors b/ipadapter/ip-adapter-plus-face_sdxl_vit-h.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..b61b565e315fa0704a5c4e4d37ec8f9f7ac3a1af --- /dev/null +++ b/ipadapter/ip-adapter-plus-face_sdxl_vit-h.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:677ad8860204f7d0bfba12d29e6c31ded9beefdf3e4bbd102518357d31a292c1 +size 847517512 diff --git a/ipadapter/ip-adapter-plus_sd15.safetensors b/ipadapter/ip-adapter-plus_sd15.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..1ab10ab02149141a0111e5ba67c0653008319121 --- /dev/null +++ b/ipadapter/ip-adapter-plus_sd15.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a1c250be40455cc61a43da1201ec3f1edaea71214865fb47f57927e06cbe4996 +size 98183288 diff --git a/ipadapter/ip-adapter-plus_sdxl_vit-h.safetensors b/ipadapter/ip-adapter-plus_sdxl_vit-h.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..0c5178c3d50123ed73ccab897d0e0b27ce682050 --- /dev/null +++ b/ipadapter/ip-adapter-plus_sdxl_vit-h.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3f5062b8400c94b7159665b21ba5c62acdcd7682262743d7f2aefedef00e6581 +size 847517512 diff --git a/ipadapter/ip-adapter_sd15.safetensors b/ipadapter/ip-adapter_sd15.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..67788447289e5858c26dbc8fbf0a7ce3fd6c50fb --- /dev/null +++ b/ipadapter/ip-adapter_sd15.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:289b45f16d043d0bf542e45831f971dcdaabe18b656f11e86d9dfba7e9ee3369 +size 44642768 diff --git a/ipadapter/ip-adapter_sd15_light.safetensors b/ipadapter/ip-adapter_sd15_light.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..c45a20f52f297aa523bedd4bee907b276aac0c3b --- /dev/null +++ b/ipadapter/ip-adapter_sd15_light.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0747d08db670535bfa286452a77d93cebad5c677b46d038543f9f2de8690bb26 +size 44642768 diff --git a/ipadapter/ip-adapter_sd15_light_v11.bin b/ipadapter/ip-adapter_sd15_light_v11.bin new file mode 100644 index 0000000000000000000000000000000000000000..f99a3f88d26faded6cc936dc4488b0d1c13aa152 --- /dev/null +++ b/ipadapter/ip-adapter_sd15_light_v11.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:350b63a57847c163e2e984b01090f85ffe60eaae20f32b2b2c9e1ccc7ddd972b +size 44642977 diff --git a/ipadapter/ip-adapter_sd15_vit-G.safetensors b/ipadapter/ip-adapter_sd15_vit-G.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..1d6f10d5b683fbaa5263b966a47e3e5fca7b240c --- /dev/null +++ b/ipadapter/ip-adapter_sd15_vit-G.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a26f736af07bb341a83dfea23713531d0575760e8ed947c68cb31a4c62d9c90b +size 46215640 diff --git a/ipadapter/ip-adapter_sdxl.safetensors b/ipadapter/ip-adapter_sdxl.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..f2945da63e0e17bc37c3c97000b82d6adbf39714 --- /dev/null +++ b/ipadapter/ip-adapter_sdxl.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ba1002529e783604c5f326d49f0122025392d1d20ac8d573b3eeb3e6dea4ebb6 +size 702585376 diff --git a/ipadapter/ip-adapter_sdxl_vit-h.safetensors b/ipadapter/ip-adapter_sdxl_vit-h.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..818af7de300965f4de4555ff19063afe46096867 --- /dev/null +++ b/ipadapter/ip-adapter_sdxl_vit-h.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ebf05d918348aec7abb02a5e9ecef77e0aaea6914a5c4ea13f50d45eb1681831 +size 698391064 diff --git a/ipadapter/ip_plus_composition_sd15.safetensors b/ipadapter/ip_plus_composition_sd15.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..7db8b186b300faa9a4695dcfbfd995ddae605e62 --- /dev/null +++ b/ipadapter/ip_plus_composition_sd15.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4a02c9f4d2ade7c0e14db7471377ce5d326a2bfda7777231c79dc861c93f2c12 +size 98183728 diff --git a/ipadapter/ip_plus_composition_sdxl.safetensors b/ipadapter/ip_plus_composition_sdxl.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..10b6c2cecdff90c86ed10b9a1c71e921b7595622 --- /dev/null +++ b/ipadapter/ip_plus_composition_sdxl.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e92dc36cc273bac3200b2e41807ebdc174076185d95a45238558d4c236b6da74 +size 847517960 diff --git a/latent_upscale_models/put_latent_upscale_models_here b/latent_upscale_models/put_latent_upscale_models_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/loras/Instagirlv2.5-HIGH.safetensors b/loras/Instagirlv2.5-HIGH.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..baebba5bb0fab2e59d231d27740eebbcf4b00f95 --- /dev/null +++ b/loras/Instagirlv2.5-HIGH.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f70b111391cfedba5613ee54e8e65cd9b5da1fd86791d7847924829533b0ada0 +size 306847440 diff --git a/loras/Instagirlv2.5-LOW.safetensors b/loras/Instagirlv2.5-LOW.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..0eaa621fe15b1161b023a7bcadd3a6db5d3dd5ad --- /dev/null +++ b/loras/Instagirlv2.5-LOW.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a0bc8c8875260d9b098cc435f83910620ed170305d9a9b02314de346b3ec4fe0 +size 2453809800 diff --git a/loras/Wan21_I2V_14B_lightx2v_cfg_step_distill_lora_rank64.safetensors b/loras/Wan21_I2V_14B_lightx2v_cfg_step_distill_lora_rank64.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..56ebfd3237c412eb06aa04e07c26d1fe137fe922 --- /dev/null +++ b/loras/Wan21_I2V_14B_lightx2v_cfg_step_distill_lora_rank64.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8833bd4fd7c8eabebf0bc8ee5cfaf47f4f310ce116928a02c1adf8941dd4b0f1 +size 739472104 diff --git a/loras/Wan_2_2_I2V_A14B_HIGH_lightx2v_MoE_distill_lora_rank_64_bf16.safetensors b/loras/Wan_2_2_I2V_A14B_HIGH_lightx2v_MoE_distill_lora_rank_64_bf16.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..2abf623313b4045c587651347a0c6939faf0ff52 --- /dev/null +++ b/loras/Wan_2_2_I2V_A14B_HIGH_lightx2v_MoE_distill_lora_rank_64_bf16.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0185333b558fc50ed2389b65a204e6a2cec5cf4c235ec627a3fe577cc7e9cd74 +size 630697104 diff --git a/loras/ipadapter/ip-adapter-faceid-plus_sd15_lora.safetensors b/loras/ipadapter/ip-adapter-faceid-plus_sd15_lora.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..5c7b0abb8c7e9384928ad821e7f9749d951b5746 --- /dev/null +++ b/loras/ipadapter/ip-adapter-faceid-plus_sd15_lora.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3f00341d11e5e7b5aadf63cbdead09ef82eb28669156161cf1bfc2105d4ff1cd +size 51059544 diff --git a/loras/ipadapter/ip-adapter-faceid-plusv2_sd15_lora.safetensors b/loras/ipadapter/ip-adapter-faceid-plusv2_sd15_lora.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..2f672477ebdee077b453a9f53bf2faf84ed02d63 --- /dev/null +++ b/loras/ipadapter/ip-adapter-faceid-plusv2_sd15_lora.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8abff87a15a049f3e0186c2e82c1c8e77783baf2cfb63f34c412656052eb57b0 +size 51059544 diff --git a/loras/ipadapter/ip-adapter-faceid-plusv2_sdxl_lora.safetensors b/loras/ipadapter/ip-adapter-faceid-plusv2_sdxl_lora.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..dfbca3de56a8767d21f2efbc1d8189075441d075 --- /dev/null +++ b/loras/ipadapter/ip-adapter-faceid-plusv2_sdxl_lora.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f24b4bb2dad6638a09c00f151cde84991baf374409385bcbab53c1871a30cb7b +size 371842896 diff --git a/loras/ipadapter/ip-adapter-faceid_sd15_lora.safetensors b/loras/ipadapter/ip-adapter-faceid_sd15_lora.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..2585fb239cb35c530903926ed8d085a8ef76bbe9 --- /dev/null +++ b/loras/ipadapter/ip-adapter-faceid_sd15_lora.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:70699f0dbfadd47de1f81d263cf4c86bd4b7271d841304af9b340b3a7f38e86a +size 51059544 diff --git a/loras/ipadapter/ip-adapter-faceid_sdxl_lora.safetensors b/loras/ipadapter/ip-adapter-faceid_sdxl_lora.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..4d02749c27bbb928770944f59caf7a4d58e495c2 --- /dev/null +++ b/loras/ipadapter/ip-adapter-faceid_sdxl_lora.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4fcf93d6e8dc8dd18f5f9e51c8306f369486ed0aa0780ade9961308aff7f0d64 +size 371842896 diff --git a/loras/put_loras_here b/loras/put_loras_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/loras/wan2.2_i2v_A14b_high_noise_lightx2v_4step_1030.safetensors b/loras/wan2.2_i2v_A14b_high_noise_lightx2v_4step_1030.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..f106508cc97f2eac312b4176da7b198d2713ed90 --- /dev/null +++ b/loras/wan2.2_i2v_A14b_high_noise_lightx2v_4step_1030.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e2daa4d4b069d9b3b091e5e2d5a96631d4676305a690a653e2c756a12c861d6f +size 28577915880 diff --git a/loras/wan2.2_i2v_A14b_low_noise_lightx2v_4step.safetensors b/loras/wan2.2_i2v_A14b_low_noise_lightx2v_4step.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..ce17c2ca90ce78705b69ffdb862d89e9645be932 --- /dev/null +++ b/loras/wan2.2_i2v_A14b_low_noise_lightx2v_4step.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a3b8680affe2ab2e2121210a83ffa7d351f77da18191e57bb359d7839beba8a2 +size 28577915880 diff --git a/loras/wan2.2_i2v_lightx2v_4steps_lora_v1_low_noise.safetensors b/loras/wan2.2_i2v_lightx2v_4steps_lora_v1_low_noise.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..2f29f8732916b98c3c8d0074256f9bc4f7739ad5 --- /dev/null +++ b/loras/wan2.2_i2v_lightx2v_4steps_lora_v1_low_noise.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:024f21de095bc8fad9809ded3e9e49a2e170dcf27075da8145ba7d60d8aab7f9 +size 1226977424 diff --git a/model_patches/put_model_patches_here b/model_patches/put_model_patches_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/nsfw_detector/vit-base-nsfw-detector/config.json b/nsfw_detector/vit-base-nsfw-detector/config.json new file mode 100644 index 0000000000000000000000000000000000000000..a0056028b3560268dee912af113b2bb88590fe93 --- /dev/null +++ b/nsfw_detector/vit-base-nsfw-detector/config.json @@ -0,0 +1,32 @@ +{ + "_name_or_path": "AdamCodd/vit-nsfw-detection", + "architectures": [ + "ViTForImageClassification" + ], + "attention_probs_dropout_prob": 0.0, + "encoder_stride": 16, + "hidden_act": "gelu", + "hidden_dropout_prob": 0.0, + "hidden_size": 768, + "id2label": { + "0": "sfw", + "1": "nsfw" + }, + "image_size": 384, + "initializer_range": 0.02, + "intermediate_size": 3072, + "label2id": { + "sfw": "0", + "nsfw": "1" + }, + "layer_norm_eps": 1e-12, + "model_type": "vit", + "num_attention_heads": 12, + "num_channels": 3, + "num_hidden_layers": 12, + "patch_size": 16, + "problem_type": "single_label_classification", + "qkv_bias": true, + "torch_dtype": "float32", + "transformers_version": "4.36.2" +} diff --git a/nsfw_detector/vit-base-nsfw-detector/model.safetensors b/nsfw_detector/vit-base-nsfw-detector/model.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..bfd28585f57a24e769c00ddf9334e4426825cced --- /dev/null +++ b/nsfw_detector/vit-base-nsfw-detector/model.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:266efb8bf67c1e865a577222fbbd6ddb149b9e00ba0d2b50466a034837f026a4 +size 344391328 diff --git a/nsfw_detector/vit-base-nsfw-detector/preprocessor_config.json b/nsfw_detector/vit-base-nsfw-detector/preprocessor_config.json new file mode 100644 index 0000000000000000000000000000000000000000..61411426b69969522fd22e2cbd60b49b530cbf2c --- /dev/null +++ b/nsfw_detector/vit-base-nsfw-detector/preprocessor_config.json @@ -0,0 +1,11 @@ +{ + "do_normalize": true, + "do_resize": true, + "image_mean": [0.5, 0.5, 0.5], + "image_processor_type": "ViTImageProcessor", + "image_std": [0.5, 0.5, 0.5], + "size": { + "height": 384, + "width": 384 + } + } \ No newline at end of file diff --git a/photomaker/put_photomaker_models_here b/photomaker/put_photomaker_models_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/pulid/pulid_flux_v0.9.1.safetensors b/pulid/pulid_flux_v0.9.1.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..185c83b328d025054c3ff7c6446dc8cb28361355 --- /dev/null +++ b/pulid/pulid_flux_v0.9.1.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:92c41c3af322b02e58e1b32842e4601e08c8f16ec1fe80089dbe957df510f51d +size 1142099520 diff --git a/pulid/pulid_v1.1.safetensors b/pulid/pulid_v1.1.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..f0d480068aaa499e9caa990b58142bda53881a32 --- /dev/null +++ b/pulid/pulid_v1.1.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4cb8ceec1078e0165399b88332ab3c5971619111b8e1730e6bae64144aabae41 +size 984405232 diff --git a/sams/sam_vit_b_01ec64.pth b/sams/sam_vit_b_01ec64.pth new file mode 100644 index 0000000000000000000000000000000000000000..ab7d111e57bd052a76fe669986560e3555e9c8f6 --- /dev/null +++ b/sams/sam_vit_b_01ec64.pth @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ec2df62732614e57411cdcf32a23ffdf28910380d03139ee0f4fcbe91eb8c912 +size 375042383 diff --git a/style_models/put_t2i_style_model_here b/style_models/put_t2i_style_model_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/text_encoders/put_text_encoder_files_here b/text_encoders/put_text_encoder_files_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/text_encoders/t5/t5xxl_fp8_e4m3fn.safetensors b/text_encoders/t5/t5xxl_fp8_e4m3fn.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..79b9ebe64019308077904fa68ed6f707569121c0 --- /dev/null +++ b/text_encoders/t5/t5xxl_fp8_e4m3fn.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7d330da4816157540d6bb7838bf63a0f02f573fc48ca4d8de34bb0cbfd514f09 +size 4893934904 diff --git a/text_encoders/umt5-xxl-enc-bf16.safetensors b/text_encoders/umt5-xxl-enc-bf16.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..60e28b4059daaa0b6f377c783cdf28cc43a00dc3 --- /dev/null +++ b/text_encoders/umt5-xxl-enc-bf16.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4fa971faf306cad919033d5bbe192e571dc08452f800cbf2ec3c73977c01b2cc +size 11361845464 diff --git a/text_encoders/umt5_xxl_fp8_e4m3fn_scaled.safetensors b/text_encoders/umt5_xxl_fp8_e4m3fn_scaled.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..f67b8b88cdc897fa83f59bbd36ad54612a534ade --- /dev/null +++ b/text_encoders/umt5_xxl_fp8_e4m3fn_scaled.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c3355d30191f1f066b26d93fba017ae9809dce6c627dda5f6a66eaa651204f68 +size 6735906897 diff --git a/ultralytics/bbox/face_yolov8m.pt b/ultralytics/bbox/face_yolov8m.pt new file mode 100644 index 0000000000000000000000000000000000000000..7448998167649f4418ec3b3d8467903512b22ced --- /dev/null +++ b/ultralytics/bbox/face_yolov8m.pt @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:717923c19b3f4bbf5250b728f1fa6b2cb72a33aed1d236ea9caf0e21ad943e5f +size 52026019 diff --git a/ultralytics/bbox/face_yolov8n.pt b/ultralytics/bbox/face_yolov8n.pt new file mode 100644 index 0000000000000000000000000000000000000000..e7223117b4a22a9806853068e5bdbb24c4b4d7aa --- /dev/null +++ b/ultralytics/bbox/face_yolov8n.pt @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:70b640f8f60b1cf0dcc72f30caf3da9495eb2fb6509da48c53374ad6806e6a9c +size 6230011 diff --git a/ultralytics/bbox/hand_yolov8s.pt b/ultralytics/bbox/hand_yolov8s.pt new file mode 100644 index 0000000000000000000000000000000000000000..ade984820a88c6111d73db1e86d375185d227f3c --- /dev/null +++ b/ultralytics/bbox/hand_yolov8s.pt @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:70b540063fbc385736d8258970744a4afbc4cbf7932134bae3b24cdadeadec06 +size 22507643 diff --git a/ultralytics/segm/face_yolov8m-seg_60.pt b/ultralytics/segm/face_yolov8m-seg_60.pt new file mode 100644 index 0000000000000000000000000000000000000000..dcb80138b5e6c05ad91a77698bc5e7c5bd853bf4 --- /dev/null +++ b/ultralytics/segm/face_yolov8m-seg_60.pt @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4a63e08009bcddee3c91af2cf9ddd513111061bdbe9d7314e7e9d187d1d85c73 +size 54813600 diff --git a/ultralytics/segm/person_yolov8m-seg.pt b/ultralytics/segm/person_yolov8m-seg.pt new file mode 100644 index 0000000000000000000000000000000000000000..7b072e035e0c72e7b62767f4ba6d53be332da820 --- /dev/null +++ b/ultralytics/segm/person_yolov8m-seg.pt @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c8ab26f517173b1fe8342d336a09f443eb61cb08dcbfc78d53fff4c2547ae81e +size 54827683 diff --git a/unet/put_unet_files_here b/unet/put_unet_files_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/upscale_models/4x-UltraSharp.pth b/upscale_models/4x-UltraSharp.pth new file mode 100644 index 0000000000000000000000000000000000000000..9f3bb839bebd6cd26c94122b7651261d0b346a50 --- /dev/null +++ b/upscale_models/4x-UltraSharp.pth @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a5812231fc936b42af08a5edba784195495d303d5b3248c24489ef0c4021fe01 +size 66961958 diff --git a/upscale_models/put_esrgan_and_other_upscale_models_here b/upscale_models/put_esrgan_and_other_upscale_models_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/vae/SDXL/sdxl_vae.safetensors b/vae/SDXL/sdxl_vae.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..5c5bfd44fb0132b3cbd9d122244f502a7cd2bb24 --- /dev/null +++ b/vae/SDXL/sdxl_vae.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:63aeecb90ff7bc1c115395962d3e803571385b61938377bc7089b36e81e92e2e +size 334641164 diff --git a/vae/put_vae_here b/vae/put_vae_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/vae/wan_2.1_vae (3).safetensors b/vae/wan_2.1_vae (3).safetensors new file mode 100644 index 0000000000000000000000000000000000000000..5ff32b52dac309662138ca42604696d34eaad7b8 --- /dev/null +++ b/vae/wan_2.1_vae (3).safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2fc39d31359a4b0a64f55876d8ff7fa8d780956ae2cb13463b0223e15148976b +size 253815318 diff --git a/vae/wan_2.1_vae.safetensors b/vae/wan_2.1_vae.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..5ff32b52dac309662138ca42604696d34eaad7b8 --- /dev/null +++ b/vae/wan_2.1_vae.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2fc39d31359a4b0a64f55876d8ff7fa8d780956ae2cb13463b0223e15148976b +size 253815318 diff --git a/vae/zImageTurbo_vae.safetensors b/vae/zImageTurbo_vae.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..71f11a92800c4a93cead7cebc556531926ecfc33 --- /dev/null +++ b/vae/zImageTurbo_vae.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:afc8e28272cd15db3919bacdb6918ce9c1ed22e96cb12c4d5ed0fba823529e38 +size 335304388 diff --git a/vae_approx/put_taesd_encoder_pth_and_taesd_decoder_pth_here b/vae_approx/put_taesd_encoder_pth_and_taesd_decoder_pth_here new file mode 100644 index 0000000000000000000000000000000000000000..e69de29bb2d1d6434b8b29ae775ad8c2e48c5391 diff --git a/vae_approx/taef1_decoder.safetensors b/vae_approx/taef1_decoder.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..8980e56a63322849905441dc75335c88061d0bdf --- /dev/null +++ b/vae_approx/taef1_decoder.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bb41500b646d5b8b592b7f3ca5d20d888c3075e209d178d99af609cd7e02a1d4 +size 2464414 diff --git a/vae_approx/taef1_encoder.safetensors b/vae_approx/taef1_encoder.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..801459cab753320713860b5d7f94d488eaa0eaad --- /dev/null +++ b/vae_approx/taef1_encoder.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:19f5a854ce575fd0a1c0a52938410cf5fb4dc4b8ae71c8887533646d8fe47030 +size 2464424 diff --git a/vae_approx/taesd3_decoder.safetensors b/vae_approx/taesd3_decoder.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..6c2b77a3206e70f3c21fd83b9ffb3675a8452485 --- /dev/null +++ b/vae_approx/taesd3_decoder.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e940e227e2a41919f0735ec423129724666f8b949c8bbce7a04b78ecfb4667de +size 2464414 diff --git a/vae_approx/taesd3_encoder.safetensors b/vae_approx/taesd3_encoder.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..46b54b137a3e5bb7614a23186da3bad6c632854f --- /dev/null +++ b/vae_approx/taesd3_encoder.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e5c96f3476bd26fe73e96d701a694f40d7ab48a290494cbbf70a3697d09cab4a +size 2464424 diff --git a/vae_approx/taesd_decoder.safetensors b/vae_approx/taesd_decoder.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..746d9a2f53666e9042f1f8a46890236a48e40a56 --- /dev/null +++ b/vae_approx/taesd_decoder.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d903e7cc3ae58f21d985a3498a841fa8b230edccff7ac5d27607b0c557945c6f +size 2450590 diff --git a/vae_approx/taesd_encoder.safetensors b/vae_approx/taesd_encoder.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..cb48f59179bf251af571e17bebfe3a7a3e7fce36 --- /dev/null +++ b/vae_approx/taesd_encoder.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a6b8c0fda4aad50784e543389e0239c72c5e31e9775c9e612ea8333bf3a77dcb +size 2450568 diff --git a/vae_approx/taesdxl_decoder.safetensors b/vae_approx/taesdxl_decoder.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..b115455398a4047737bfc532eddfc1a284278e8d --- /dev/null +++ b/vae_approx/taesdxl_decoder.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ae5256b046b01d577279ed93a55bbb1fb2689e55aa14cfc0f7f841e0160202a5 +size 2450590 diff --git a/vae_approx/taesdxl_encoder.safetensors b/vae_approx/taesdxl_encoder.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..8cdb4395d6601bc900c3ad8b0b27fcf7675026f4 --- /dev/null +++ b/vae_approx/taesdxl_encoder.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3d78013286676a1a51074831230f90972e573698fe4b11416d6f28e0cd5bbe7e +size 2450568 diff --git a/xlabs/ipadapters/ip_adapter.safetensors b/xlabs/ipadapters/ip_adapter.safetensors new file mode 100644 index 0000000000000000000000000000000000000000..61800d1f50912ebb61e9f4f9ecf67dfc5b0924e3 --- /dev/null +++ b/xlabs/ipadapters/ip_adapter.safetensors @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:750f912149b84bbb0c2a6ce90ffa7e78afd1795821407718724ebcd36372dc2d +size 981760648