Files changed (1) hide show
  1. config.json +90 -0
config.json ADDED
@@ -0,0 +1,90 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "model_family": "VisionHOPE",
3
+ "code_repository": "https://github.com/PSRben/VisionHOPE",
4
+ "backbone_defaults": {
5
+ "in_chans": 3,
6
+ "head_dim": 16,
7
+ "chunk_sizes": null,
8
+ "mlp_ratios": [4.0, 4.0, 4.0, 4.0],
9
+ "local_mode": "gated_dwconv7",
10
+ "norm_layer": "layernorm2d",
11
+ "layer_scale_init_value": 1e-06,
12
+ "use_grn": true,
13
+ "use_mlp_dwconv": true,
14
+ "use_direction_scale": true,
15
+ "direction_merge": "sum",
16
+ "use_block_cpe": true,
17
+ "use_output_lepe": true,
18
+ "share_direction_skip": true
19
+ },
20
+ "backbones": {
21
+ "visionhope_tiny": {
22
+ "embed_dims": [64, 128, 256, 512],
23
+ "mixer_dims": [32, 64, 128, 256],
24
+ "depths": [3, 4, 18, 4]
25
+ },
26
+ "visionhope_small": {
27
+ "embed_dims": [64, 160, 320, 512],
28
+ "mixer_dims": [32, 80, 160, 256],
29
+ "depths": [4, 8, 25, 8]
30
+ },
31
+ "visionhope_base": {
32
+ "embed_dims": [96, 192, 448, 640],
33
+ "mixer_dims": [48, 96, 224, 320],
34
+ "depths": [4, 8, 25, 8]
35
+ }
36
+ },
37
+ "tasks": {
38
+ "classification": {
39
+ "dataset": "ImageNet-1K",
40
+ "model_class": "HierarchicalVisionHOPE",
41
+ "model_kwargs": {
42
+ "num_classes": 1000,
43
+ "projection_dim": 1024
44
+ },
45
+ "preprocessing": {
46
+ "input_size": [3, 224, 224],
47
+ "crop_pct": 1.0,
48
+ "interpolation": "bicubic",
49
+ "mean": [0.485, 0.456, 0.406],
50
+ "std": [0.229, 0.224, 0.225]
51
+ },
52
+ "checkpoints": {
53
+ "visionhope_tiny": "visionhope_tiny.pth",
54
+ "visionhope_small": "visionhope_small.pth",
55
+ "visionhope_base": "visionhope_base.pth"
56
+ }
57
+ },
58
+ "detection": {
59
+ "dataset": "COCO",
60
+ "framework": "MMDetection",
61
+ "model_class": "MaskRCNN",
62
+ "num_classes": 80,
63
+ "config_builder": "visionhope.tasks.detection.config.build_config",
64
+ "checkpoints": {
65
+ "1x": {
66
+ "visionhope_tiny": "visionhope_tiny_coco_1x.pth",
67
+ "visionhope_small": "visionhope_small_coco_1x.pth",
68
+ "visionhope_base": "visionhope_base_coco_1x.pth"
69
+ },
70
+ "3x": {
71
+ "visionhope_tiny": "visionhope_tiny_coco_3x.pth",
72
+ "visionhope_small": "visionhope_small_coco_3x.pth"
73
+ }
74
+ }
75
+ },
76
+ "segmentation": {
77
+ "dataset": "ADE20K",
78
+ "framework": "MMSegmentation",
79
+ "model_class": "EncoderDecoder",
80
+ "decode_head": "UPerHead",
81
+ "num_classes": 150,
82
+ "config_builder": "visionhope.tasks.segmentation.config.build_config",
83
+ "checkpoints": {
84
+ "visionhope_tiny": "visionhope_tiny_ade20k.pth",
85
+ "visionhope_small": "visionhope_small_ade20k.pth",
86
+ "visionhope_base": "visionhope_base_ade20k.pth"
87
+ }
88
+ }
89
+ }
90
+ }