hieptruong-vbhp commited on
Commit
6bde68c
·
verified ·
1 Parent(s): ef42738

Upload folder using huggingface_hub

Browse files
.gitattributes CHANGED
@@ -33,3 +33,7 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
 
 
 
 
 
33
  *.zip filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ checkpoint-54/54.pdema filter=lfs diff=lfs merge=lfs -text
37
+ checkpoint-54/54.pdopt filter=lfs diff=lfs merge=lfs -text
38
+ checkpoint-54/54.pdparams filter=lfs diff=lfs merge=lfs -text
39
+ inference/inference.pdiparams filter=lfs diff=lfs merge=lfs -text
.ipynb_checkpoints/config-checkpoint.yaml ADDED
@@ -0,0 +1,285 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ DETR:
2
+ backbone: PPHGNetV2
3
+ detr_head: DocLayoutV3Head
4
+ neck: MaskHybridEncoder
5
+ post_process: DocLayoutV3PostProcess
6
+ transformer: DocLayoutV3Transformer
7
+ DocLayoutV3Head:
8
+ loss:
9
+ aux_loss: true
10
+ loss_coeff:
11
+ bbox: 5
12
+ class: 4
13
+ dice: 5
14
+ giou: 2
15
+ mask: 5
16
+ order: 50
17
+ matcher:
18
+ matcher_coeff:
19
+ bbox: 5
20
+ class: 4
21
+ dice: 5
22
+ giou: 2
23
+ mask: 5
24
+ name: HungarianMatcher
25
+ name: DocLayoutV3Loss
26
+ use_focal_loss: true
27
+ use_vfl: true
28
+ vfl_iou_type: mask
29
+ DocLayoutV3Metric:
30
+ eval_mask: false
31
+ DocLayoutV3PostProcess:
32
+ mask_stride: 4
33
+ num_top_queries: 300
34
+ resize_mask: false
35
+ DocLayoutV3Transformer:
36
+ activation: relu
37
+ box_noise_scale: 1.0
38
+ dim_feedforward: 1024
39
+ dropout: 0.0
40
+ feat_strides:
41
+ - 8
42
+ - 16
43
+ - 32
44
+ label_noise_ratio: 0.5
45
+ learnt_init_query: false
46
+ mask_enhanced: true
47
+ nhead: 8
48
+ num_denoising: 0
49
+ num_levels: 3
50
+ num_queries: 300
51
+ position_embed_type: sine
52
+ EvalDataset:
53
+ anno_path: annotations/instance_val.json
54
+ dataset_dir: /root/work/paddleocr-det/PaddleX/paddlex/dataset/handwriting
55
+ image_dir: images
56
+ name: COCOInstSegDataset
57
+ EvalReader:
58
+ batch_size: 1
59
+ drop_last: false
60
+ sample_transforms:
61
+ - Decode: {}
62
+ - Resize:
63
+ interp: 2
64
+ keep_ratio: false
65
+ target_size:
66
+ - 800
67
+ - 800
68
+ - NormalizeImage:
69
+ mean:
70
+ - 0.0
71
+ - 0.0
72
+ - 0.0
73
+ norm_type: none
74
+ std:
75
+ - 1.0
76
+ - 1.0
77
+ - 1.0
78
+ - Permute: {}
79
+ shuffle: false
80
+ LearningRate:
81
+ base_lr: 0.0001
82
+ schedulers:
83
+ - !PiecewiseDecay
84
+ gamma:
85
+ - 1.0
86
+ milestones:
87
+ - 100
88
+ use_warmup: true
89
+ values: null
90
+ - !LinearWarmup
91
+ epochs: null
92
+ epochs_first: false
93
+ start_factor: 0.001
94
+ steps: 200
95
+ MaskHybridEncoder:
96
+ encoder_layer:
97
+ activation: gelu
98
+ d_model: 256
99
+ dim_feedforward: 1024
100
+ dropout: 0.0
101
+ name: TransformerLayer
102
+ nhead: 8
103
+ expansion: 1.0
104
+ hidden_dim: 256
105
+ mask_feat_channels:
106
+ - 64
107
+ - 64
108
+ num_encoder_layers: 1
109
+ use_encoder_idx:
110
+ - 3
111
+ OptimizerBuilder:
112
+ clip_grad_by_norm: 0.1
113
+ optimizer:
114
+ type: AdamW
115
+ weight_decay: 0.0001
116
+ regularizer: false
117
+ PPHGNetV2:
118
+ arch: L
119
+ freeze_at: 0
120
+ freeze_norm: true
121
+ freeze_stem_only: true
122
+ lr_mult_list:
123
+ - 0.0
124
+ - 0.05
125
+ - 0.05
126
+ - 0.05
127
+ - 0.05
128
+ return_idx:
129
+ - 0
130
+ - 1
131
+ - 2
132
+ - 3
133
+ TestDataset: !ImageFolder
134
+ anno_path: annotations/instance_val.json
135
+ dataset_dir: /root/work/paddleocr-det/PaddleX/paddlex/dataset/handwriting
136
+ image_dir: ''
137
+ sample_num: -1
138
+ use_default_label: null
139
+ TestReader:
140
+ batch_size: 1
141
+ drop_last: false
142
+ inputs_def:
143
+ image_shape:
144
+ - 3
145
+ - 800
146
+ - 800
147
+ sample_transforms:
148
+ - Decode: {}
149
+ - Resize:
150
+ interp: 2
151
+ keep_ratio: false
152
+ target_size:
153
+ - 800
154
+ - 800
155
+ - NormalizeImage:
156
+ mean:
157
+ - 0.0
158
+ - 0.0
159
+ - 0.0
160
+ norm_type: none
161
+ std:
162
+ - 1.0
163
+ - 1.0
164
+ - 1.0
165
+ - Permute: {}
166
+ shuffle: false
167
+ TrainDataset:
168
+ anno_path: annotations/instance_train.json
169
+ data_fields:
170
+ - image
171
+ - gt_bbox
172
+ - gt_class
173
+ - gt_poly
174
+ - is_crowd
175
+ - gt_read_order
176
+ dataset_dir: /root/work/paddleocr-det/PaddleX/paddlex/dataset/handwriting
177
+ image_dir: images
178
+ name: COCOInstSegDataset
179
+ TrainReader:
180
+ batch_size: 8
181
+ batch_transforms:
182
+ - BatchRandomResize:
183
+ keep_ratio: false
184
+ random_interp: true
185
+ random_size: true
186
+ target_size:
187
+ - 672
188
+ - 704
189
+ - 736
190
+ - 768
191
+ - 800
192
+ - 800
193
+ - 800
194
+ - 800
195
+ - 832
196
+ - 864
197
+ - 896
198
+ - 928
199
+ - UnpackMask: {}
200
+ - NormalizeImage:
201
+ mean:
202
+ - 0.0
203
+ - 0.0
204
+ - 0.0
205
+ norm_type: none
206
+ std:
207
+ - 1.0
208
+ - 1.0
209
+ - 1.0
210
+ - NormalizeBox: {}
211
+ - BboxXYXY2XYWH: {}
212
+ - Permute: {}
213
+ collate_batch: false
214
+ drop_last: true
215
+ sample_transforms:
216
+ - Decode: {}
217
+ - Poly2MaskPack:
218
+ del_poly: true
219
+ - RandomDistort:
220
+ prob: 0.8
221
+ - UpdateBBoxFromMask: {}
222
+ - RandomExpand:
223
+ fill_value:
224
+ - 123.675
225
+ - 116.28
226
+ - 103.53
227
+ prob: 0.5
228
+ ratio: 1.5
229
+ - RandomCrop:
230
+ prob: 0.8
231
+ use_box_candidates: true
232
+ shuffle: true
233
+ use_shared_memory: true
234
+ amp: false
235
+ architecture: DETR
236
+ ema_decay: 0.9999
237
+ ema_decay_type: exponential
238
+ ema_filter_no_grad: true
239
+ enable_ce: false
240
+ epoch: 200
241
+ eval: true
242
+ eval_size:
243
+ - 800
244
+ - 800
245
+ export:
246
+ benchmark: false
247
+ fuse_conv_bn: false
248
+ nms: true
249
+ post_process: true
250
+ export_with_pir: true
251
+ filename: instancesegmodel_PP-DocLayoutV3
252
+ find_unused_parameters: true
253
+ fleet: false
254
+ hidden_dim: 256
255
+ log_iter: 10
256
+ metric: DocLayoutV3Metric
257
+ norm_type: sync_bn
258
+ num_classes: 6
259
+ num_prototypes: 32
260
+ pdx_model_name: PP-DocLayoutV3
261
+ pretrain_weights: /root/work/paddleocr-det/PaddleX/PP-DocLayoutV3_pretrained.pdparams
262
+ print_flops: false
263
+ print_params: false
264
+ profiler_options: null
265
+ proposals_path: sniper/proposals.json
266
+ resume: null
267
+ save_dir: /root/work/paddleocr-det/PaddleX/output
268
+ save_prediction_only: false
269
+ save_proposals: false
270
+ snapshot_epoch: 5
271
+ target_metrics: mask
272
+ to_static: false
273
+ uniform_output_enabled: true
274
+ use_ema: true
275
+ use_focal_loss: true
276
+ use_gpu: true
277
+ use_iluvatar_gpu: false
278
+ use_mlu: false
279
+ use_npu: false
280
+ use_vdl: true
281
+ use_wandb: false
282
+ use_xpu: false
283
+ vdl_log_dir: /root/work/paddleocr-det/PaddleX/output
284
+ with_mask: true
285
+ worker_num: 24
check_dataset_result.json ADDED
@@ -0,0 +1,53 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "done_flag": true,
3
+ "check_pass": true,
4
+ "attributes": {
5
+ "num_classes": 6,
6
+ "train_samples": 12612,
7
+ "train_sample_paths": [
8
+ "check_dataset\/demo_img\/IMG_3087.jpg",
9
+ "check_dataset\/demo_img\/IMG_3203.jpg",
10
+ "check_dataset\/demo_img\/IMG_2603.jpg",
11
+ "check_dataset\/demo_img\/IMG_1558.jpg",
12
+ "check_dataset\/demo_img\/IMG_2656.jpg",
13
+ "check_dataset\/demo_img\/IMG_1405.jpg",
14
+ "check_dataset\/demo_img\/IMG_1291.jpg",
15
+ "check_dataset\/demo_img\/IMG_1471.jpg",
16
+ "check_dataset\/demo_img\/IMG_2073.jpg",
17
+ "check_dataset\/demo_img\/IMG_3326.jpg"
18
+ ],
19
+ "val_samples": 1454,
20
+ "val_sample_paths": [
21
+ "check_dataset\/demo_img\/IMG_3197.jpg",
22
+ "check_dataset\/demo_img\/4cfa0dec-02d9-44df-be65-67cf14562540.jpg",
23
+ "check_dataset\/demo_img\/IMG_3147.jpg",
24
+ "check_dataset\/demo_img\/IMG_2023.jpg",
25
+ "check_dataset\/demo_img\/IMG_1335.jpg",
26
+ "check_dataset\/demo_img\/IMG_3240.jpg",
27
+ "check_dataset\/demo_img\/IMG_2250.jpg",
28
+ "check_dataset\/demo_img\/IMG_3591.jpg",
29
+ "check_dataset\/demo_img\/IMG_3625.jpg",
30
+ "check_dataset\/demo_img\/IMG_3262.jpg"
31
+ ],
32
+ "read_order_validation": {
33
+ "instance_train": {
34
+ "total_images": 2119,
35
+ "valid_images": 2119,
36
+ "invalid_images": [],
37
+ "pass_rate": 1.0
38
+ },
39
+ "instance_val": {
40
+ "total_images": 236,
41
+ "valid_images": 236,
42
+ "invalid_images": [],
43
+ "pass_rate": 1.0
44
+ }
45
+ }
46
+ },
47
+ "analysis": {
48
+ "histogram": "check_dataset\/histogram.png"
49
+ },
50
+ "dataset_path": "handwriting",
51
+ "show_type": "image",
52
+ "dataset_type": "COCOInstSegDataset"
53
+ }
checkpoint-54/.ipynb_checkpoints/54.info-checkpoint.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"metric": 0.0, "epoch": 55}
checkpoint-54/54.info.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"metric": 0.0, "epoch": 55}
checkpoint-54/54.pdema ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:0fd8de42ff8635510bea7863908ae017e531e95bd507d2d4112b495a646b6f97
3
+ size 133222291
checkpoint-54/54.pdopt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a8ebe428c3dd4dab2ce2a586d905698f7de0641aba63e7a545692b0a594fb995
3
+ size 265302158
checkpoint-54/54.pdparams ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e91fe515c85693f3db3e1e0244781cdc3fd316bb5327ec425c9a047b85df16eb
3
+ size 133211611
checkpoint-54/54.pdstates ADDED
Binary file (44 Bytes). View file
 
config.yaml ADDED
@@ -0,0 +1,285 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ DETR:
2
+ backbone: PPHGNetV2
3
+ detr_head: DocLayoutV3Head
4
+ neck: MaskHybridEncoder
5
+ post_process: DocLayoutV3PostProcess
6
+ transformer: DocLayoutV3Transformer
7
+ DocLayoutV3Head:
8
+ loss:
9
+ aux_loss: true
10
+ loss_coeff:
11
+ bbox: 5
12
+ class: 4
13
+ dice: 5
14
+ giou: 2
15
+ mask: 5
16
+ order: 50
17
+ matcher:
18
+ matcher_coeff:
19
+ bbox: 5
20
+ class: 4
21
+ dice: 5
22
+ giou: 2
23
+ mask: 5
24
+ name: HungarianMatcher
25
+ name: DocLayoutV3Loss
26
+ use_focal_loss: true
27
+ use_vfl: true
28
+ vfl_iou_type: mask
29
+ DocLayoutV3Metric:
30
+ eval_mask: false
31
+ DocLayoutV3PostProcess:
32
+ mask_stride: 4
33
+ num_top_queries: 300
34
+ resize_mask: false
35
+ DocLayoutV3Transformer:
36
+ activation: relu
37
+ box_noise_scale: 1.0
38
+ dim_feedforward: 1024
39
+ dropout: 0.0
40
+ feat_strides:
41
+ - 8
42
+ - 16
43
+ - 32
44
+ label_noise_ratio: 0.5
45
+ learnt_init_query: false
46
+ mask_enhanced: true
47
+ nhead: 8
48
+ num_denoising: 0
49
+ num_levels: 3
50
+ num_queries: 300
51
+ position_embed_type: sine
52
+ EvalDataset:
53
+ anno_path: annotations/instance_val.json
54
+ dataset_dir: /root/work/paddleocr-det/PaddleX/paddlex/dataset/handwriting
55
+ image_dir: images
56
+ name: COCOInstSegDataset
57
+ EvalReader:
58
+ batch_size: 1
59
+ drop_last: false
60
+ sample_transforms:
61
+ - Decode: {}
62
+ - Resize:
63
+ interp: 2
64
+ keep_ratio: false
65
+ target_size:
66
+ - 800
67
+ - 800
68
+ - NormalizeImage:
69
+ mean:
70
+ - 0.0
71
+ - 0.0
72
+ - 0.0
73
+ norm_type: none
74
+ std:
75
+ - 1.0
76
+ - 1.0
77
+ - 1.0
78
+ - Permute: {}
79
+ shuffle: false
80
+ LearningRate:
81
+ base_lr: 0.0001
82
+ schedulers:
83
+ - !PiecewiseDecay
84
+ gamma:
85
+ - 1.0
86
+ milestones:
87
+ - 100
88
+ use_warmup: true
89
+ values: null
90
+ - !LinearWarmup
91
+ epochs: null
92
+ epochs_first: false
93
+ start_factor: 0.001
94
+ steps: 200
95
+ MaskHybridEncoder:
96
+ encoder_layer:
97
+ activation: gelu
98
+ d_model: 256
99
+ dim_feedforward: 1024
100
+ dropout: 0.0
101
+ name: TransformerLayer
102
+ nhead: 8
103
+ expansion: 1.0
104
+ hidden_dim: 256
105
+ mask_feat_channels:
106
+ - 64
107
+ - 64
108
+ num_encoder_layers: 1
109
+ use_encoder_idx:
110
+ - 3
111
+ OptimizerBuilder:
112
+ clip_grad_by_norm: 0.1
113
+ optimizer:
114
+ type: AdamW
115
+ weight_decay: 0.0001
116
+ regularizer: false
117
+ PPHGNetV2:
118
+ arch: L
119
+ freeze_at: 0
120
+ freeze_norm: true
121
+ freeze_stem_only: true
122
+ lr_mult_list:
123
+ - 0.0
124
+ - 0.05
125
+ - 0.05
126
+ - 0.05
127
+ - 0.05
128
+ return_idx:
129
+ - 0
130
+ - 1
131
+ - 2
132
+ - 3
133
+ TestDataset: !ImageFolder
134
+ anno_path: annotations/instance_val.json
135
+ dataset_dir: /root/work/paddleocr-det/PaddleX/paddlex/dataset/handwriting
136
+ image_dir: ''
137
+ sample_num: -1
138
+ use_default_label: null
139
+ TestReader:
140
+ batch_size: 1
141
+ drop_last: false
142
+ inputs_def:
143
+ image_shape:
144
+ - 3
145
+ - 800
146
+ - 800
147
+ sample_transforms:
148
+ - Decode: {}
149
+ - Resize:
150
+ interp: 2
151
+ keep_ratio: false
152
+ target_size:
153
+ - 800
154
+ - 800
155
+ - NormalizeImage:
156
+ mean:
157
+ - 0.0
158
+ - 0.0
159
+ - 0.0
160
+ norm_type: none
161
+ std:
162
+ - 1.0
163
+ - 1.0
164
+ - 1.0
165
+ - Permute: {}
166
+ shuffle: false
167
+ TrainDataset:
168
+ anno_path: annotations/instance_train.json
169
+ data_fields:
170
+ - image
171
+ - gt_bbox
172
+ - gt_class
173
+ - gt_poly
174
+ - is_crowd
175
+ - gt_read_order
176
+ dataset_dir: /root/work/paddleocr-det/PaddleX/paddlex/dataset/handwriting
177
+ image_dir: images
178
+ name: COCOInstSegDataset
179
+ TrainReader:
180
+ batch_size: 8
181
+ batch_transforms:
182
+ - BatchRandomResize:
183
+ keep_ratio: false
184
+ random_interp: true
185
+ random_size: true
186
+ target_size:
187
+ - 672
188
+ - 704
189
+ - 736
190
+ - 768
191
+ - 800
192
+ - 800
193
+ - 800
194
+ - 800
195
+ - 832
196
+ - 864
197
+ - 896
198
+ - 928
199
+ - UnpackMask: {}
200
+ - NormalizeImage:
201
+ mean:
202
+ - 0.0
203
+ - 0.0
204
+ - 0.0
205
+ norm_type: none
206
+ std:
207
+ - 1.0
208
+ - 1.0
209
+ - 1.0
210
+ - NormalizeBox: {}
211
+ - BboxXYXY2XYWH: {}
212
+ - Permute: {}
213
+ collate_batch: false
214
+ drop_last: true
215
+ sample_transforms:
216
+ - Decode: {}
217
+ - Poly2MaskPack:
218
+ del_poly: true
219
+ - RandomDistort:
220
+ prob: 0.8
221
+ - UpdateBBoxFromMask: {}
222
+ - RandomExpand:
223
+ fill_value:
224
+ - 123.675
225
+ - 116.28
226
+ - 103.53
227
+ prob: 0.5
228
+ ratio: 1.5
229
+ - RandomCrop:
230
+ prob: 0.8
231
+ use_box_candidates: true
232
+ shuffle: true
233
+ use_shared_memory: true
234
+ amp: false
235
+ architecture: DETR
236
+ ema_decay: 0.9999
237
+ ema_decay_type: exponential
238
+ ema_filter_no_grad: true
239
+ enable_ce: false
240
+ epoch: 200
241
+ eval: true
242
+ eval_size:
243
+ - 800
244
+ - 800
245
+ export:
246
+ benchmark: false
247
+ fuse_conv_bn: false
248
+ nms: true
249
+ post_process: true
250
+ export_with_pir: true
251
+ filename: instancesegmodel_PP-DocLayoutV3
252
+ find_unused_parameters: true
253
+ fleet: false
254
+ hidden_dim: 256
255
+ log_iter: 10
256
+ metric: DocLayoutV3Metric
257
+ norm_type: sync_bn
258
+ num_classes: 6
259
+ num_prototypes: 32
260
+ pdx_model_name: PP-DocLayoutV3
261
+ pretrain_weights: /root/work/paddleocr-det/PaddleX/PP-DocLayoutV3_pretrained.pdparams
262
+ print_flops: false
263
+ print_params: false
264
+ profiler_options: null
265
+ proposals_path: sniper/proposals.json
266
+ resume: null
267
+ save_dir: /root/work/paddleocr-det/PaddleX/output
268
+ save_prediction_only: false
269
+ save_proposals: false
270
+ snapshot_epoch: 5
271
+ target_metrics: mask
272
+ to_static: false
273
+ uniform_output_enabled: true
274
+ use_ema: true
275
+ use_focal_loss: true
276
+ use_gpu: true
277
+ use_iluvatar_gpu: false
278
+ use_mlu: false
279
+ use_npu: false
280
+ use_vdl: true
281
+ use_wandb: false
282
+ use_xpu: false
283
+ vdl_log_dir: /root/work/paddleocr-det/PaddleX/output
284
+ with_mask: true
285
+ worker_num: 24
inference/.ipynb_checkpoints/inference-checkpoint.yml ADDED
@@ -0,0 +1,82 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ mode: paddle
2
+ draw_threshold: 0.5
3
+ metric: DocLayoutV3Metric
4
+ use_dynamic_shape: false
5
+ Global:
6
+ model_name: PP-DocLayoutV3
7
+ arch: DETR
8
+ min_subgraph_size: 3
9
+ mask: true
10
+ Preprocess:
11
+ - interp: 2
12
+ keep_ratio: false
13
+ target_size:
14
+ - 800
15
+ - 800
16
+ type: Resize
17
+ - mean:
18
+ - 0.0
19
+ - 0.0
20
+ - 0.0
21
+ norm_type: none
22
+ std:
23
+ - 1.0
24
+ - 1.0
25
+ - 1.0
26
+ type: NormalizeImage
27
+ - type: Permute
28
+ label_list:
29
+ - exercise
30
+ - figure
31
+ - question
32
+ - table
33
+ - text
34
+ - unknown
35
+ Hpi:
36
+ backend_configs:
37
+ paddle_infer:
38
+ trt_dynamic_shapes: &id001
39
+ image:
40
+ - - 1
41
+ - 3
42
+ - 800
43
+ - 800
44
+ - - 1
45
+ - 3
46
+ - 800
47
+ - 800
48
+ - - 8
49
+ - 3
50
+ - 800
51
+ - 800
52
+ scale_factor:
53
+ - - 1
54
+ - 2
55
+ - - 1
56
+ - 2
57
+ - - 8
58
+ - 2
59
+ trt_dynamic_shape_input_data:
60
+ scale_factor:
61
+ - - 2
62
+ - 2
63
+ - - 1
64
+ - 1
65
+ - - 0.67
66
+ - 0.67
67
+ - 0.67
68
+ - 0.67
69
+ - 0.67
70
+ - 0.67
71
+ - 0.67
72
+ - 0.67
73
+ - 0.67
74
+ - 0.67
75
+ - 0.67
76
+ - 0.67
77
+ - 0.67
78
+ - 0.67
79
+ - 0.67
80
+ - 0.67
81
+ tensorrt:
82
+ dynamic_shapes: *id001
inference/inference.json ADDED
The diff for this file is too large to render. See raw diff
 
inference/inference.pdiparams ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5d60164c404fb3a2136d2e8e92c262e59358ba50d7b11e34291bfe8973a55110
3
+ size 129235195
inference/inference.yml ADDED
@@ -0,0 +1,82 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ mode: paddle
2
+ draw_threshold: 0.5
3
+ metric: DocLayoutV3Metric
4
+ use_dynamic_shape: false
5
+ Global:
6
+ model_name: PP-DocLayoutV3
7
+ arch: DETR
8
+ min_subgraph_size: 3
9
+ mask: true
10
+ Preprocess:
11
+ - interp: 2
12
+ keep_ratio: false
13
+ target_size:
14
+ - 800
15
+ - 800
16
+ type: Resize
17
+ - mean:
18
+ - 0.0
19
+ - 0.0
20
+ - 0.0
21
+ norm_type: none
22
+ std:
23
+ - 1.0
24
+ - 1.0
25
+ - 1.0
26
+ type: NormalizeImage
27
+ - type: Permute
28
+ label_list:
29
+ - exercise
30
+ - figure
31
+ - question
32
+ - table
33
+ - text
34
+ - unknown
35
+ Hpi:
36
+ backend_configs:
37
+ paddle_infer:
38
+ trt_dynamic_shapes: &id001
39
+ image:
40
+ - - 1
41
+ - 3
42
+ - 800
43
+ - 800
44
+ - - 1
45
+ - 3
46
+ - 800
47
+ - 800
48
+ - - 8
49
+ - 3
50
+ - 800
51
+ - 800
52
+ scale_factor:
53
+ - - 1
54
+ - 2
55
+ - - 1
56
+ - 2
57
+ - - 8
58
+ - 2
59
+ trt_dynamic_shape_input_data:
60
+ scale_factor:
61
+ - - 2
62
+ - 2
63
+ - - 1
64
+ - 1
65
+ - - 0.67
66
+ - 0.67
67
+ - 0.67
68
+ - 0.67
69
+ - 0.67
70
+ - 0.67
71
+ - 0.67
72
+ - 0.67
73
+ - 0.67
74
+ - 0.67
75
+ - 0.67
76
+ - 0.67
77
+ - 0.67
78
+ - 0.67
79
+ - 0.67
80
+ - 0.67
81
+ tensorrt:
82
+ dynamic_shapes: *id001
train.log ADDED
The diff for this file is too large to render. See raw diff
 
train_result.json ADDED
@@ -0,0 +1 @@
 
 
1
+ {"model_name": "PP-DocLayoutV3", "label_dict": "", "visualdl_log": "", "train_log": "train.log", "config": "config.yaml", "models": {"last_1": {"score": 0.0, "pdparams": "164/164.pdparams", "pdopt": "164/164.pdopt", "pdstates": "164/164.pdstates", "pdema": "164/164.pdema", "inference_config": "164/inference/inference.yml", "pdmodel": "164/inference/inference.json", "pdiparams": "164/inference/inference.pdiparams"}, "last_2": {"score": 0.0, "pdparams": "159/159.pdparams", "pdopt": "159/159.pdopt", "pdstates": "159/159.pdstates", "pdema": "159/159.pdema", "inference_config": "159/inference/inference.yml", "pdmodel": "159/inference/inference.json", "pdiparams": "159/inference/inference.pdiparams"}, "last_3": {"score": 0.0, "pdparams": "154/154.pdparams", "pdopt": "154/154.pdopt", "pdstates": "154/154.pdstates", "pdema": "154/154.pdema", "inference_config": "154/inference/inference.yml", "pdmodel": "154/inference/inference.json", "pdiparams": "154/inference/inference.pdiparams"}, "last_4": {"score": 0.0, "pdparams": "149/149.pdparams", "pdopt": "149/149.pdopt", "pdstates": "149/149.pdstates", "pdema": "149/149.pdema", "inference_config": "149/inference/inference.yml", "pdmodel": "149/inference/inference.json", "pdiparams": "149/inference/inference.pdiparams"}, "last_5": {"score": 0.0, "pdparams": "144/144.pdparams", "pdopt": "144/144.pdopt", "pdstates": "144/144.pdstates", "pdema": "144/144.pdema", "inference_config": "144/inference/inference.yml", "pdmodel": "144/inference/inference.json", "pdiparams": "144/inference/inference.pdiparams"}, "best": {"score": 0.0, "pdparams": "best_model/best_model.pdparams", "pdopt": "best_model/best_model.pdopt", "pdstates": "best_model/best_model.pdstates", "pdema": "best_model/best_model.pdema", "inference_config": "best_model/inference/inference.yml", "pdmodel": "best_model/inference/inference.json", "pdiparams": "best_model/inference/inference.pdiparams"}}, "done_flag": false}