Upload training/NOTES.md with huggingface_hub
Browse files- training/NOTES.md +8 -0
training/NOTES.md
CHANGED
|
@@ -92,6 +92,14 @@ folga de VRAM protege contra freeze near-OOM, e o custo do swap no H3 é ~5% —
|
|
| 92 |
- 05:42 lançado tmux `h3quick`: cache completo (3.885 itens, batch 4) → treino 2 épocas encadeado
|
| 93 |
- Log: /workspace/logs/quick_pipeline.log
|
| 94 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 95 |
## Publicação HF (resolvido 10/08)
|
| 96 |
Repo `AdwolfCzar/minih33-loop-i2v` — público (sem custo de cota privada) + gated manual
|
| 97 |
(arquivos só baixáveis com aprovação do dono). Regra do usuário: nunca mencionar "minimax" no
|
|
|
|
| 92 |
- 05:42 lançado tmux `h3quick`: cache completo (3.885 itens, batch 4) → treino 2 épocas encadeado
|
| 93 |
- Log: /workspace/logs/quick_pipeline.log
|
| 94 |
|
| 95 |
+
## Medições de cache (10/08 06:00-06:40)
|
| 96 |
+
- Latents batch 4: ~7 s/item; batch 12: ~5 s/item; batch 24: ~1,7-6,5 s/item conforme grupo de
|
| 97 |
+
frames (124f domina). GPU 100% — VAE encode é o gargalo real; batch >24 não deve ajudar.
|
| 98 |
+
- TE em paralelo com latents na mesma GPU: FRACASSO (TE 11-12 s/item vs ~1,6 solo; latents +14%).
|
| 99 |
+
GPU time-slicing serializa com overhead. Regra: estágios de cache SEMPRE seriais em single-GPU.
|
| 100 |
+
- Checkpoints do treino ajustados a pedido do usuário: a cada 500 steps (sampling idem);
|
| 101 |
+
states retidos: últimos 1500 steps.
|
| 102 |
+
|
| 103 |
## Publicação HF (resolvido 10/08)
|
| 104 |
Repo `AdwolfCzar/minih33-loop-i2v` — público (sem custo de cota privada) + gated manual
|
| 105 |
(arquivos só baixáveis com aprovação do dono). Regra do usuário: nunca mencionar "minimax" no
|