AdwolfCzar commited on
Commit
b5b5d4c
·
verified ·
1 Parent(s): 35689fc

Upload training/NOTES.md with huggingface_hub

Browse files
Files changed (1) hide show
  1. training/NOTES.md +5 -2
training/NOTES.md CHANGED
@@ -54,8 +54,11 @@ Views por symlink em `/workspace/datasets/train_quick/`; manifest em `configs/bu
54
  - Dataset completo fase 2 = loopcut (19.7k) + mega_curated (3.9k) ≈ 23,6k clipes
55
  - Normalização 24fps concluída 10/08 06:5x: 19.746 ok (1 duplicata), zero falhas, 43 GB em loopcut_24
56
  - Extensão de loops (mesma escada 124/90/73/56) → loopcut_24_ext, iniciada em seguida
57
- - ATENÇÃO disco p/ fase 2: calcular antes do caching (ext ~100 GB + caches ~150 GB); liberar
58
- loopcut_extract_tmp (28 GB) e zips (52 GB, reconstruíveis do HF) se necessário
 
 
 
59
 
60
  ## Log de execução
61
  - 2026-08-10 04:1x: downloads iniciados (modelos ~86 GB, dataset completo ~52 GB) — xet, muito rápido
 
54
  - Dataset completo fase 2 = loopcut (19.7k) + mega_curated (3.9k) ≈ 23,6k clipes
55
  - Normalização 24fps concluída 10/08 06:5x: 19.746 ok (1 duplicata), zero falhas, 43 GB em loopcut_24
56
  - Extensão de loops (mesma escada 124/90/73/56) → loopcut_24_ext, iniciada em seguida
57
+ - Extensão loopcut concluída: 4.592 tiled + 15.154 linked (clipes naturalmente longos), 8,3 GB.
58
+ Histograma: 124f×16490 (84%!), 107×1774, 90×1100, 73×269, 56×113
59
+ - Config fase 2 deve reintroduzir diversidade de duração: sub-datasets por bucket com max_frames
60
+ 124/90/73 via symlinks (per-dataset max_frames no TOML, sem re-encode)
61
+ - Disco p/ fase 2: caches ~100-140 GB estimados, 341 GB livres — cabe; recalcular antes do caching
62
 
63
  ## Log de execução
64
  - 2026-08-10 04:1x: downloads iniciados (modelos ~86 GB, dataset completo ~52 GB) — xet, muito rápido