SamuelFoo eazevedo commited on
Commit
a7a6d7a
·
0 Parent(s):

Duplicate from robot-learning/v2w_ex1_ex2_all_lora_rank32_lr5.623e-05_bsz32_630062_2

Browse files

Co-authored-by: Emerson Leonardo Azevedo Aguiar <eazevedo@users.noreply.huggingface.co>

Files changed (44) hide show
  1. .gitattributes +35 -0
  2. checkpoints/latest_checkpoint.txt +0 -0
  3. checkpoints/model/iter_000000590.pt +3 -0
  4. checkpoints/model/iter_000000590_fused.pt +3 -0
  5. checkpoints/model/iter_000000595.pt +3 -0
  6. checkpoints/model/iter_000000595_fused.pt +3 -0
  7. checkpoints/model/iter_000000600.pt +3 -0
  8. checkpoints/model/iter_000000600_fused.pt +3 -0
  9. checkpoints/model/iter_000000605.pt +3 -0
  10. checkpoints/model/iter_000000605_fused.pt +3 -0
  11. checkpoints/model/iter_000000610.pt +3 -0
  12. checkpoints/model/iter_000000610_fused.pt +3 -0
  13. checkpoints/optim/iter_000000590.pt +3 -0
  14. checkpoints/optim/iter_000000590_fused.pt +3 -0
  15. checkpoints/optim/iter_000000595.pt +3 -0
  16. checkpoints/optim/iter_000000595_fused.pt +3 -0
  17. checkpoints/optim/iter_000000600.pt +3 -0
  18. checkpoints/optim/iter_000000600_fused.pt +3 -0
  19. checkpoints/optim/iter_000000605.pt +3 -0
  20. checkpoints/optim/iter_000000605_fused.pt +3 -0
  21. checkpoints/optim/iter_000000610.pt +3 -0
  22. checkpoints/optim/iter_000000610_fused.pt +3 -0
  23. checkpoints/scheduler/iter_000000590.pt +3 -0
  24. checkpoints/scheduler/iter_000000590_fused.pt +3 -0
  25. checkpoints/scheduler/iter_000000595.pt +3 -0
  26. checkpoints/scheduler/iter_000000595_fused.pt +3 -0
  27. checkpoints/scheduler/iter_000000600.pt +3 -0
  28. checkpoints/scheduler/iter_000000600_fused.pt +3 -0
  29. checkpoints/scheduler/iter_000000605.pt +3 -0
  30. checkpoints/scheduler/iter_000000605_fused.pt +3 -0
  31. checkpoints/scheduler/iter_000000610.pt +3 -0
  32. checkpoints/scheduler/iter_000000610_fused.pt +3 -0
  33. checkpoints/trainer/iter_000000590.pt +3 -0
  34. checkpoints/trainer/iter_000000590_fused.pt +3 -0
  35. checkpoints/trainer/iter_000000595.pt +3 -0
  36. checkpoints/trainer/iter_000000595_fused.pt +3 -0
  37. checkpoints/trainer/iter_000000600.pt +3 -0
  38. checkpoints/trainer/iter_000000600_fused.pt +3 -0
  39. checkpoints/trainer/iter_000000605.pt +3 -0
  40. checkpoints/trainer/iter_000000605_fused.pt +3 -0
  41. checkpoints/trainer/iter_000000610.pt +3 -0
  42. checkpoints/trainer/iter_000000610_fused.pt +3 -0
  43. config.pkl +3 -0
  44. config.yaml +530 -0
.gitattributes ADDED
@@ -0,0 +1,35 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ *.7z filter=lfs diff=lfs merge=lfs -text
2
+ *.arrow filter=lfs diff=lfs merge=lfs -text
3
+ *.bin filter=lfs diff=lfs merge=lfs -text
4
+ *.bz2 filter=lfs diff=lfs merge=lfs -text
5
+ *.ckpt filter=lfs diff=lfs merge=lfs -text
6
+ *.ftz filter=lfs diff=lfs merge=lfs -text
7
+ *.gz filter=lfs diff=lfs merge=lfs -text
8
+ *.h5 filter=lfs diff=lfs merge=lfs -text
9
+ *.joblib filter=lfs diff=lfs merge=lfs -text
10
+ *.lfs.* filter=lfs diff=lfs merge=lfs -text
11
+ *.mlmodel filter=lfs diff=lfs merge=lfs -text
12
+ *.model filter=lfs diff=lfs merge=lfs -text
13
+ *.msgpack filter=lfs diff=lfs merge=lfs -text
14
+ *.npy filter=lfs diff=lfs merge=lfs -text
15
+ *.npz filter=lfs diff=lfs merge=lfs -text
16
+ *.onnx filter=lfs diff=lfs merge=lfs -text
17
+ *.ot filter=lfs diff=lfs merge=lfs -text
18
+ *.parquet filter=lfs diff=lfs merge=lfs -text
19
+ *.pb filter=lfs diff=lfs merge=lfs -text
20
+ *.pickle filter=lfs diff=lfs merge=lfs -text
21
+ *.pkl filter=lfs diff=lfs merge=lfs -text
22
+ *.pt filter=lfs diff=lfs merge=lfs -text
23
+ *.pth filter=lfs diff=lfs merge=lfs -text
24
+ *.rar filter=lfs diff=lfs merge=lfs -text
25
+ *.safetensors filter=lfs diff=lfs merge=lfs -text
26
+ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
27
+ *.tar.* filter=lfs diff=lfs merge=lfs -text
28
+ *.tar filter=lfs diff=lfs merge=lfs -text
29
+ *.tflite filter=lfs diff=lfs merge=lfs -text
30
+ *.tgz filter=lfs diff=lfs merge=lfs -text
31
+ *.wasm filter=lfs diff=lfs merge=lfs -text
32
+ *.xz filter=lfs diff=lfs merge=lfs -text
33
+ *.zip filter=lfs diff=lfs merge=lfs -text
34
+ *.zst filter=lfs diff=lfs merge=lfs -text
35
+ *tfevents* filter=lfs diff=lfs merge=lfs -text
checkpoints/latest_checkpoint.txt ADDED
File without changes
checkpoints/model/iter_000000590.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:285b01d818b49ad793981af80624610d901a262cc0a76777cc8717b8ff54b28e
3
+ size 4005911812
checkpoints/model/iter_000000590_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7c3aca1735e21737f43a9685a4f47199dd6ba810dc111d95dc591ebd253e87b0
3
+ size 3913047915
checkpoints/model/iter_000000595.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:67103bc6eafe62ed2f380fddb2672f01798d44896829f0af0fe747d0f1610cf1
3
+ size 4005911812
checkpoints/model/iter_000000595_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1b0a04820dd39f018227a85652171d5b69377d9bd779dd2bfad1cbf363d09ca0
3
+ size 3913047915
checkpoints/model/iter_000000600.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7f7173c0eb6a232679fa14347b562c2c06678880698cacb9682e9eecb0c861dd
3
+ size 4005911812
checkpoints/model/iter_000000600_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:178a887b416060f10459b44e52fae4441c2b1684866a145bb457987005436e8e
3
+ size 3913047915
checkpoints/model/iter_000000605.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:07d37d4d01cfd415a4bf66d98a00807446614494c07c97bb6a70d200ba9d4d17
3
+ size 4005911812
checkpoints/model/iter_000000605_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a6b93f3ee921e74156bc6940e5392f4243a1eebcca1cf472fe82b67b8d8b5fb8
3
+ size 3913047915
checkpoints/model/iter_000000610.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:da7c55c4ed0fd8f9d035af6f65a2a216952db27bef1da99bc1cbadf6ac0ecd04
3
+ size 4005911812
checkpoints/model/iter_000000610_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:83d5a53bd59d6c7fdb52c96f47bc40f7796fe8e248e915c09d71fdfda075c10a
3
+ size 3913047915
checkpoints/optim/iter_000000590.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:017657786dc386c94d3a2bcc0b0b08b2b21ea0c9ce748db9ef71846c6efdf1a5
3
+ size 1792982648
checkpoints/optim/iter_000000590_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c5d17ff684fe2933d27ae654c75b0566ce974347c8fc0dfd99a3b426c83637f9
3
+ size 1792991522
checkpoints/optim/iter_000000595.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:77dbe181547d4dae4bd8a6ad9ad501225abd60680682ddfbc2b69bf962d27a13
3
+ size 1792982648
checkpoints/optim/iter_000000595_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3f94395e497b35a0284042299f9abaa84e5ca4808206cc61598295a58ef2969b
3
+ size 1792991522
checkpoints/optim/iter_000000600.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:0d23ba5c7ef70de07244145c4200b73500ec9c95a3199d8d0276a7dafefa0642
3
+ size 1792982648
checkpoints/optim/iter_000000600_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1e9a885662f035ea7491d3f7c54968b23bb7f8eeead7e3cf34b7af4318a1ec31
3
+ size 1792991522
checkpoints/optim/iter_000000605.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e499b7a202d4d6c7ce801ee20963df5e8a3f35da8502095467d1e2c4c771af88
3
+ size 1792982648
checkpoints/optim/iter_000000605_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a41b1fd94d3572c8909d227c82eeaaff8e45c71487927e5d94121ea5d2147fc4
3
+ size 1792991522
checkpoints/optim/iter_000000610.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9f4e108d10e7e21aefd25c78273ebe8c12139f60826495ace929d9b3c5bb4d7a
3
+ size 1792982648
checkpoints/optim/iter_000000610_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5da69730060a4cc685acdb8722be981aa93b0aa477fe170ab6c0f1777eec50ed
3
+ size 1792991522
checkpoints/scheduler/iter_000000590.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:843d52709b0a7b2ce3e7c6fc6b6b9dd644d74a7226b530a723e37a2c3356e77a
3
+ size 1602
checkpoints/scheduler/iter_000000590_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:b6e2f958451789d9d0acdfea937b0569cbce74d367bd49e0c7f6050ea95cdd30
3
+ size 1638
checkpoints/scheduler/iter_000000595.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f1d703258fe6231f1dede549faa059a10546c8dd38de316e408971b690f4fd5d
3
+ size 1602
checkpoints/scheduler/iter_000000595_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:b8350861157f431535565e2daca2c18b0cf53835b1c936d1a4d0b5dbb6cd14ee
3
+ size 1638
checkpoints/scheduler/iter_000000600.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d63df3fb8fee4688d10c1a3ebd7a65a9326f72bdf2958cd2413b1cac4007e839
3
+ size 1602
checkpoints/scheduler/iter_000000600_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5cace1acf96a130c825274b1741a7b3e0d03ef331a133a30a5a88320585e7506
3
+ size 1638
checkpoints/scheduler/iter_000000605.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a3d01fa815d8198d98065158b901e9add4fed1194b12132384dfbdb6fb55557c
3
+ size 1602
checkpoints/scheduler/iter_000000605_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:59969cb88626c2a2c48e74a5555241b989e07b8a4f91f00de09c69a2e0acf036
3
+ size 1638
checkpoints/scheduler/iter_000000610.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:8ca11ac803b0f8d8cf61848ad6ac950fb066a2376bed5647a966baef1c9866d2
3
+ size 1602
checkpoints/scheduler/iter_000000610_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9c9f90f51d77358e1286ad373b50a4c17acb964364aef917010a65f73d3dfce7
3
+ size 1638
checkpoints/trainer/iter_000000590.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1eea0474f5fa546d584fd2317b7be832c4f9850d66ae5895c519fb9098f909e3
3
+ size 892
checkpoints/trainer/iter_000000590_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:00d148eb2716c82109bcc4d1fca29665da42bfb46ff7b7282462f6a60d2aafbd
3
+ size 916
checkpoints/trainer/iter_000000595.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9431c415f6c7f62f69c166d72229b7ae41ef92ecb95ceacb39c913fa845c08ae
3
+ size 892
checkpoints/trainer/iter_000000595_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:92857fc8440d3c706d9327364f0a40eacaec745a5dd02fa7d7b4b2abb56f4e18
3
+ size 916
checkpoints/trainer/iter_000000600.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3d4241c8657960fc56d56e303b2f10176953d10a3c4c475826e14070d4f889bd
3
+ size 892
checkpoints/trainer/iter_000000600_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:21f10a27589d2d11e6e540100fff437f4d2eb8f47d51f65bda87706bc922ea66
3
+ size 916
checkpoints/trainer/iter_000000605.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:842245e8cd923d3d58df3354a72d97222cde22a95ce40d471319d9d8afd8928d
3
+ size 892
checkpoints/trainer/iter_000000605_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:41ebf6a2dc265de8465099c3bdc25349dfd2cf67493d44f83998111653495491
3
+ size 916
checkpoints/trainer/iter_000000610.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3c9d4b5845a309da593453ce13b71741af8e30885038ef179ca83c990d96e1c4
3
+ size 892
checkpoints/trainer/iter_000000610_fused.pt ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f8e0ab481cb56269bb0fe7fe9e5ffe8558715dffce593003e03ad5d802025cb8
3
+ size 916
config.pkl ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1b8d893e2dd035cd2978c76de99bb1377dfac113d97b98931c712a1a7930d67d
3
+ size 75030
config.yaml ADDED
@@ -0,0 +1,530 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ checkpoint:
2
+ broadcast_via_filesystem: 'False'
3
+ dcp_allow_mismatched_size: 'False'
4
+ dcp_async_mode_enabled: 'False'
5
+ jit:
6
+ device: cuda
7
+ dtype: bfloat16
8
+ enabled: 'False'
9
+ input_shape: null
10
+ strict: 'True'
11
+ keys_not_to_resume: []
12
+ load_ema_to_reg: 'False'
13
+ load_path: ''
14
+ load_training_state: 'False'
15
+ only_load_scheduler_state: 'False'
16
+ save_iter: '5'
17
+ strict_resume: 'True'
18
+ type:
19
+ _target_: <class 'cosmos_predict2.checkpointer.Checkpointer'>
20
+ callbacks: null
21
+ verbose: 'True'
22
+ data_config: null
23
+ dataloader_train:
24
+ _target_: <class 'torch.utils.data.dataloader.DataLoader'>
25
+ batch_sampler: null
26
+ batch_size: '2'
27
+ collate_fn: null
28
+ dataset:
29
+ _target_: <class 'cosmos_predict2.data.dataset_video.MultiDataset'>
30
+ ex1_all:
31
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
32
+ data_fps: '10.0'
33
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex1_all-cosmos-video
34
+ exclude_with_substring: null
35
+ include_only_with_substrings: null
36
+ is_multi_img: 'False'
37
+ is_val: 'False'
38
+ num_frames: '61'
39
+ obs_history: '5'
40
+ val_ratio: '0.0'
41
+ video_size:
42
+ - '480'
43
+ - '640'
44
+ ex2_all:
45
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
46
+ data_fps: '10.0'
47
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex2_all-cosmos-video
48
+ exclude_with_substring: null
49
+ include_only_with_substrings: null
50
+ is_multi_img: 'False'
51
+ is_val: 'False'
52
+ num_frames: '61'
53
+ obs_history: '5'
54
+ val_ratio: '0.0'
55
+ video_size:
56
+ - '480'
57
+ - '640'
58
+ drop_last: 'True'
59
+ generator: null
60
+ in_order: 'False'
61
+ multiprocessing_context: null
62
+ num_workers: '12'
63
+ persistent_workers: 'True'
64
+ pin_memory: 'True'
65
+ pin_memory_device: ''
66
+ prefetch_factor: '8'
67
+ sampler:
68
+ _target_: <function get_sampler at 0x7333e173a440>
69
+ dataset:
70
+ _target_: <class 'cosmos_predict2.data.dataset_video.MultiDataset'>
71
+ ex1_all:
72
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
73
+ data_fps: '10.0'
74
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex1_all-cosmos-video
75
+ exclude_with_substring: null
76
+ include_only_with_substrings: null
77
+ is_multi_img: 'False'
78
+ is_val: 'False'
79
+ num_frames: '61'
80
+ obs_history: '5'
81
+ val_ratio: '0.0'
82
+ video_size:
83
+ - '480'
84
+ - '640'
85
+ ex2_all:
86
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
87
+ data_fps: '10.0'
88
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex2_all-cosmos-video
89
+ exclude_with_substring: null
90
+ include_only_with_substrings: null
91
+ is_multi_img: 'False'
92
+ is_val: 'False'
93
+ num_frames: '61'
94
+ obs_history: '5'
95
+ val_ratio: '0.0'
96
+ video_size:
97
+ - '480'
98
+ - '640'
99
+ shuffle: null
100
+ timeout: '0'
101
+ worker_init_fn: null
102
+ dataloader_val:
103
+ _target_: <class 'torch.utils.data.dataloader.DataLoader'>
104
+ batch_sampler: null
105
+ batch_size: '1'
106
+ collate_fn: null
107
+ dataset:
108
+ _target_: <class 'cosmos_predict2.data.dataset_video.MultiDataset'>
109
+ ex1_all:
110
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
111
+ data_fps: '10.0'
112
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex1_all-cosmos-video
113
+ exclude_with_substring: null
114
+ include_only_with_substrings: null
115
+ is_multi_img: 'False'
116
+ is_val: 'True'
117
+ num_frames: '61'
118
+ obs_history: '5'
119
+ val_ratio: '0.0'
120
+ video_size:
121
+ - '480'
122
+ - '640'
123
+ ex2_all:
124
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
125
+ data_fps: '10.0'
126
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex2_all-cosmos-video
127
+ exclude_with_substring: null
128
+ include_only_with_substrings: null
129
+ is_multi_img: 'False'
130
+ is_val: 'True'
131
+ num_frames: '61'
132
+ obs_history: '5'
133
+ val_ratio: '0.0'
134
+ video_size:
135
+ - '480'
136
+ - '640'
137
+ drop_last: 'False'
138
+ generator: null
139
+ in_order: 'False'
140
+ multiprocessing_context: null
141
+ num_workers: '0'
142
+ persistent_workers: 'False'
143
+ pin_memory: 'False'
144
+ pin_memory_device: ''
145
+ prefetch_factor: null
146
+ sampler:
147
+ _target_: <function get_sampler at 0x7333e173a440>
148
+ dataset:
149
+ _target_: <class 'cosmos_predict2.data.dataset_video.MultiDataset'>
150
+ ex1_all:
151
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
152
+ data_fps: '10.0'
153
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex1_all-cosmos-video
154
+ exclude_with_substring: null
155
+ include_only_with_substrings: null
156
+ is_multi_img: 'False'
157
+ is_val: 'True'
158
+ num_frames: '61'
159
+ obs_history: '5'
160
+ val_ratio: '0.0'
161
+ video_size:
162
+ - '480'
163
+ - '640'
164
+ ex2_all:
165
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
166
+ data_fps: '10.0'
167
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex2_all-cosmos-video
168
+ exclude_with_substring: null
169
+ include_only_with_substrings: null
170
+ is_multi_img: 'False'
171
+ is_val: 'True'
172
+ num_frames: '61'
173
+ obs_history: '5'
174
+ val_ratio: '0.0'
175
+ video_size:
176
+ - '480'
177
+ - '640'
178
+ shuffle: null
179
+ timeout: '0'
180
+ worker_init_fn: null
181
+ defaults:
182
+ - _self_
183
+ - data_config: null
184
+ - video_dataset_train: null
185
+ - video_dataset_val: null
186
+ - dataloader_train: null
187
+ - dataloader_val: null
188
+ - world2action_pipe: null
189
+ - optimizer: fusedadamw
190
+ - scheduler: constant
191
+ - model: null
192
+ - callbacks:
193
+ - basic
194
+ - net: null
195
+ - ema: null
196
+ - checkpoint: null
197
+ - ckpt_type: null
198
+ - experiment: null
199
+ job:
200
+ group: video2world
201
+ name: v2w_ex1_ex2_all_lora_rank32_lr5.623e-05_bsz32_630062
202
+ project: posttraining
203
+ model:
204
+ _recursive_: 'False'
205
+ _target_: <class 'cosmos_predict2.models.video2world_model.Predict2Video2WorldModel'>
206
+ config:
207
+ adjust_video_noise: true
208
+ debug_without_randomness: false
209
+ fsdp_shard_size: 0
210
+ high_sigma_ratio: 0.05
211
+ init_lora_weights: true
212
+ input_image_key: images
213
+ input_video_key: video
214
+ lora_alpha: 32
215
+ lora_rank: 32
216
+ lora_target_modules: q_proj,k_proj,v_proj,output_proj,x_embedder.proj.1,linear_1,linear_2,mlp.layer1,mlp.layer2
217
+ loss_reduce: mean
218
+ loss_scale: 100.0
219
+ model_manager_config:
220
+ _target_: cosmos_predict2.models.video2world_model.Predict2ModelManagerConfig
221
+ dit_path: /home/nvidia/robot_learning_project/mimic-video/model/checkpoints/video_backbone//v2w_pretrained_cosmos.pt
222
+ text_encoder_path: ''
223
+ pipe_config:
224
+ adjust_video_noise: true
225
+ conditioner:
226
+ _target_: <class 'cosmos_predict2.conditioner.VideoConditioner'>
227
+ fps:
228
+ _target_: <class 'cosmos_predict2.conditioner.ReMapkey'>
229
+ dropout_rate: '0.0'
230
+ dtype: null
231
+ input_key: fps
232
+ output_key: fps
233
+ padding_mask:
234
+ _target_: <class 'cosmos_predict2.conditioner.ReMapkey'>
235
+ dropout_rate: '0.0'
236
+ dtype: null
237
+ input_key: padding_mask
238
+ output_key: padding_mask
239
+ text:
240
+ _target_: <class 'cosmos_predict2.conditioner.TextAttr'>
241
+ dropout_rate: '0.0'
242
+ input_key:
243
+ - obs/language_embedding
244
+ use_video_condition:
245
+ _target_: <class 'cosmos_predict2.conditioner.BooleanFlag'>
246
+ dropout_rate: '0.0'
247
+ input_key: fps
248
+ output_key: use_video_condition
249
+ conditioning_strategy: frame_replace
250
+ ema:
251
+ _target_: cosmos_predict2.configs.defaults.ema.EMAConfig
252
+ enabled: 'False'
253
+ iteration_shift: '0'
254
+ rate: '0.1'
255
+ guardrail_config:
256
+ checkpoint_dir: /home/nvidia/robot_learning_project/mimic-video/model/checkpoints
257
+ enabled: false
258
+ offload_model_to_cpu: true
259
+ input_image_key: images
260
+ input_video_key: video
261
+ max_num_conditional_frames: 2
262
+ min_num_conditional_frames: 1
263
+ net:
264
+ _target_: <class 'cosmos_predict2.models.video2world_dit.MinimalV1LVGDiT'>
265
+ adaln_lora_dim: '256'
266
+ atten_backend: minimal_a2a
267
+ concat_padding_mask: 'True'
268
+ extra_per_block_abs_pos_emb: 'False'
269
+ in_channels: '16'
270
+ max_frames: '128'
271
+ max_img_h: '240'
272
+ max_img_w: '240'
273
+ model_channels: '2048'
274
+ num_blocks: '28'
275
+ num_heads: '16'
276
+ out_channels: '16'
277
+ patch_spatial: '2'
278
+ patch_temporal: '1'
279
+ pos_emb_cls: rope3d
280
+ pos_emb_interpolation: crop
281
+ pos_emb_learnable: 'True'
282
+ rope_enable_fps_modulation: 'False'
283
+ rope_h_extrapolation_ratio: '3.0'
284
+ rope_t_extrapolation_ratio: '1.0'
285
+ rope_w_extrapolation_ratio: '3.0'
286
+ sac_config:
287
+ _target_: cosmos_predict2.models.text2image_dit.SACConfig
288
+ every_n_blocks: '1'
289
+ mode: predict2_2b_720
290
+ use_adaln_lora: 'True'
291
+ precision: bfloat16
292
+ rectified_flow_loss_weight_uniform: true
293
+ rectified_flow_t_scaling_factor: 1.0
294
+ resize_online: false
295
+ resolution: '480'
296
+ sigma_conditional: 0.0001
297
+ sigma_data: 1.0
298
+ state_ch: 16
299
+ state_t: 16
300
+ text_encoder:
301
+ cls: !!python/object/apply:imaginaire.constants.TextEncoderClass
302
+ - t5
303
+ t5:
304
+ ckpt_path: /home/nvidia/robot_learning_project/mimic-video/model/checkpoints/text_encoder/t5-11b
305
+ embed_dim: 1024
306
+ num_tokens: 512
307
+ timestamps:
308
+ is_forward: false
309
+ nfe: 35
310
+ order: 7.0
311
+ t_max: 80.0
312
+ t_min: 0.002
313
+ tokenizer:
314
+ _target_: <class 'cosmos_predict2.tokenizers.tokenizer.TokenizerInterface'>
315
+ chunk_duration: '81'
316
+ load_mean_std: 'False'
317
+ name: tokenizer
318
+ temporal_window: '16'
319
+ vae_pth: /home/nvidia/robot_learning_project/mimic-video/model/checkpoints/video_backbone//tokenizer/tokenizer.pth
320
+ precision: bfloat16
321
+ train_architecture: lora
322
+ model_parallel:
323
+ _cpu_offloading_context: null
324
+ async_tensor_model_parallel_allreduce: false
325
+ autocast_dtype: torch.float32
326
+ barrier_with_L1_time: true
327
+ batch_p2p_comm: true
328
+ batch_p2p_sync: true
329
+ bf16: false
330
+ context_parallel_size: 1
331
+ cpu_offloading: false
332
+ cpu_offloading_activations: false
333
+ cpu_offloading_num_layers: 0
334
+ cpu_offloading_weights: false
335
+ cross_entropy_fusion_impl: native
336
+ cross_entropy_loss_fusion: false
337
+ deallocate_pipeline_outputs: false
338
+ defer_embedding_wgrad_compute: false
339
+ deterministic_mode: false
340
+ enable_autocast: false
341
+ expert_model_parallel_size: 1
342
+ expert_tensor_parallel_size: 1
343
+ finalize_model_grads_func: null
344
+ fp16: false
345
+ grad_scale_func: null
346
+ grad_sync_func: null
347
+ gradient_accumulation_fusion: false
348
+ hierarchical_context_parallel_sizes: null
349
+ microbatch_group_size_per_vp_stage: 1
350
+ moe_extended_tp: false
351
+ no_sync_func: null
352
+ num_microbatches_with_partial_activation_checkpoints: null
353
+ overlap_p2p_comm: false
354
+ overlap_p2p_comm_warmup_flush: false
355
+ param_sync_func: null
356
+ params_dtype: torch.float32
357
+ perform_initialization: true
358
+ pipeline_dtype: null
359
+ pipeline_model_parallel_comm_backend: null
360
+ pipeline_model_parallel_size: 1
361
+ pipeline_model_parallel_split_rank: null
362
+ sequence_parallel: false
363
+ tensor_model_parallel_size: 1
364
+ timers: null
365
+ tp_comm_atomic_ag: false
366
+ tp_comm_atomic_rs: false
367
+ tp_comm_bootstrap_backend: nccl
368
+ tp_comm_bulk_dgrad: true
369
+ tp_comm_bulk_wgrad: true
370
+ tp_comm_overlap: false
371
+ tp_comm_overlap_ag: true
372
+ tp_comm_overlap_disable_fc1: false
373
+ tp_comm_overlap_disable_qkv: false
374
+ tp_comm_overlap_rs: true
375
+ tp_comm_overlap_rs_dgrad: false
376
+ tp_comm_split_ag: true
377
+ tp_comm_split_rs: true
378
+ use_cpu_initialization: false
379
+ use_ring_exchange_p2p: false
380
+ use_te_rng_tracker: false
381
+ variable_seq_lengths: false
382
+ virtual_pipeline_model_parallel_size: null
383
+ wgrad_deferral_limit: 0
384
+ optimizer:
385
+ _target_: <function get_base_optimizer at 0x7333d19b72e0>
386
+ betas:
387
+ - '0.9'
388
+ - '0.99'
389
+ capturable: 'True'
390
+ eps: 1e-08
391
+ lr: '5.623e-05'
392
+ master_weights: 'True'
393
+ model: null
394
+ optim_type: fusedadam
395
+ weight_decay: '0.1'
396
+ scheduler:
397
+ _target_: <class 'cosmos_predict2.configs.defaults.scheduler.ConstantScheduler'>
398
+ trainer:
399
+ callbacks:
400
+ device_monitor:
401
+ _target_: <class 'cosmos_predict2.callbacks.device_monitor.DeviceMonitor'>
402
+ every_n: '1'
403
+ log_memory_detail: 'True'
404
+ step_size: '1'
405
+ ema:
406
+ _target_: <class 'imaginaire.utils.callback.EMAModelCallback'>
407
+ config: null
408
+ trainer: null
409
+ grad_clip:
410
+ _target_: <class 'cosmos_predict2.callbacks.grad_clip.GradClip'>
411
+ clip_norm: '10.0'
412
+ force_finite: 'True'
413
+ log_wandb: 'False'
414
+ iter_speed:
415
+ _target_: <class 'cosmos_predict2.callbacks.iter_speed.IterSpeed'>
416
+ every_n: '1'
417
+ hit_thres: '5'
418
+ low_prec:
419
+ _target_: <class 'imaginaire.utils.callback.LowPrecisionCallback'>
420
+ config: null
421
+ trainer: null
422
+ update_iter: '1'
423
+ manual_gc:
424
+ _target_: <class 'imaginaire.callbacks.manual_gc.ManualGarbageCollection'>
425
+ every_n: '5'
426
+ warm_up: '5'
427
+ progress_bar:
428
+ _target_: <class 'imaginaire.utils.callback.ProgressBarCallback'>
429
+ config: null
430
+ trainer: null
431
+ video_eval:
432
+ _target_: <class 'cosmos_predict2.callbacks.video_eval.VideoEvalCallback'>
433
+ fuse_lora: 'True'
434
+ wandb:
435
+ _target_: <class 'cosmos_predict2.callbacks.wandb_logger.WandBLogger'>
436
+ enabled: 'True'
437
+ entity: robot-learning-wm
438
+ log_every_n: '1'
439
+ mode: online
440
+ project: cosmos-video-finetune
441
+ cudnn:
442
+ benchmark: 'True'
443
+ deterministic: 'False'
444
+ ddp:
445
+ broadcast_buffers: 'True'
446
+ find_unused_parameters: 'False'
447
+ static_graph: 'True'
448
+ distributed_parallelism: ddp
449
+ grad_accum_iter: '8'
450
+ grad_scaler_args:
451
+ enabled: 'False'
452
+ logging_iter: '1'
453
+ max_iter: '1000000'
454
+ max_val_iter: null
455
+ memory_format: torch.preserve_format
456
+ profiling:
457
+ enable_memory_snapshot: 'False'
458
+ enable_profiling: 'False'
459
+ first_n_rank: '4'
460
+ profile_freq: '1'
461
+ profile_memory: 'True'
462
+ record_shape: 'True'
463
+ with_modules: 'True'
464
+ with_stack: 'True'
465
+ run_validation: 'False'
466
+ seed: '0'
467
+ timeout_period: '999999999'
468
+ type: <class 'imaginaire.trainer.ImaginaireTrainer'>
469
+ validation_iter: '999999999'
470
+ video_dataset_train:
471
+ _target_: <class 'cosmos_predict2.data.dataset_video.MultiDataset'>
472
+ ex1_all:
473
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
474
+ data_fps: '10.0'
475
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex1_all-cosmos-video
476
+ exclude_with_substring: null
477
+ include_only_with_substrings: null
478
+ is_multi_img: 'False'
479
+ is_val: 'False'
480
+ num_frames: '61'
481
+ obs_history: '5'
482
+ val_ratio: '0.0'
483
+ video_size:
484
+ - '480'
485
+ - '640'
486
+ ex2_all:
487
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
488
+ data_fps: '10.0'
489
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex2_all-cosmos-video
490
+ exclude_with_substring: null
491
+ include_only_with_substrings: null
492
+ is_multi_img: 'False'
493
+ is_val: 'False'
494
+ num_frames: '61'
495
+ obs_history: '5'
496
+ val_ratio: '0.0'
497
+ video_size:
498
+ - '480'
499
+ - '640'
500
+ video_dataset_val:
501
+ _target_: <class 'cosmos_predict2.data.dataset_video.MultiDataset'>
502
+ ex1_all:
503
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
504
+ data_fps: '10.0'
505
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex1_all-cosmos-video
506
+ exclude_with_substring: null
507
+ include_only_with_substrings: null
508
+ is_multi_img: 'False'
509
+ is_val: 'True'
510
+ num_frames: '61'
511
+ obs_history: '5'
512
+ val_ratio: '0.0'
513
+ video_size:
514
+ - '480'
515
+ - '640'
516
+ ex2_all:
517
+ _target_: <class 'cosmos_predict2.data.dataset_video.Dataset'>
518
+ data_fps: '10.0'
519
+ dataset_dir: /home/nvidia/robot_learning_project/data/ex2_all-cosmos-video
520
+ exclude_with_substring: null
521
+ include_only_with_substrings: null
522
+ is_multi_img: 'False'
523
+ is_val: 'True'
524
+ num_frames: '61'
525
+ obs_history: '5'
526
+ val_ratio: '0.0'
527
+ video_size:
528
+ - '480'
529
+ - '640'
530
+ world2action_pipe: null