vitb16-beast-calms21 / training.log
themattinthehatt's picture
Upload 5 files
9345e14 verified
Raw
History Blame Contribute Delete
6.37 kB
2026-02-14 04:56:08,699 INFO BEAST.CLI.TRAIN : Training <class 'beast.models.vits.VisionTransformer'> model
2026-02-14 04:56:08,699 INFO BEAST.CLI.TRAIN : Data directory: /tmp/data/calms21
2026-02-14 04:56:08,699 INFO BEAST.CLI.TRAIN : Output directory: /teamspace/studios/this_studio/results/calms21/beast
2026-02-14 04:56:12,321 INFO lightning.pytorch.utilities.rank_zero : GPU available: True (cuda), used: True
2026-02-14 04:56:12,322 INFO lightning.pytorch.utilities.rank_zero : TPU available: False, using: 0 TPU cores
2026-02-14 04:56:12,322 INFO lightning.pytorch.utilities.rank_zero : HPU available: False, using: 0 HPUs
2026-02-14 04:56:12,516 INFO lightning.pytorch.utilities.rank_zero : You are using a CUDA device ('NVIDIA L40S') that has Tensor Cores. To properly utilize them, you should set `torch.set_float32_matmul_precision('medium' | 'high')` which will trade-off precision for performance. For more details, read https://pytorch.org/docs/stable/generated/torch.set_float32_matmul_precision.html#torch.set_float32_matmul_precision
2026-02-14 04:56:12,516 INFO lightning.fabric.utilities.distributed : Initializing distributed: GLOBAL_RANK: 0, MEMBER: 1/8
2026-02-14 04:56:18,180 INFO BEAST.CLI.TRAIN : Training <class 'beast.models.vits.VisionTransformer'> model
2026-02-14 04:56:18,180 INFO BEAST.CLI.TRAIN : Data directory: /tmp/data/calms21
2026-02-14 04:56:18,180 INFO BEAST.CLI.TRAIN : Output directory: /teamspace/studios/this_studio/results/calms21/beast
2026-02-14 04:56:18,202 INFO BEAST.CLI.TRAIN : Training <class 'beast.models.vits.VisionTransformer'> model
2026-02-14 04:56:18,202 INFO BEAST.CLI.TRAIN : Data directory: /tmp/data/calms21
2026-02-14 04:56:18,202 INFO BEAST.CLI.TRAIN : Output directory: /teamspace/studios/this_studio/results/calms21/beast
2026-02-14 04:56:18,249 INFO BEAST.CLI.TRAIN : Training <class 'beast.models.vits.VisionTransformer'> model
2026-02-14 04:56:18,249 INFO BEAST.CLI.TRAIN : Data directory: /tmp/data/calms21
2026-02-14 04:56:18,249 INFO BEAST.CLI.TRAIN : Output directory: /teamspace/studios/this_studio/results/calms21/beast
2026-02-14 04:56:18,260 INFO BEAST.CLI.TRAIN : Training <class 'beast.models.vits.VisionTransformer'> model
2026-02-14 04:56:18,260 INFO BEAST.CLI.TRAIN : Data directory: /tmp/data/calms21
2026-02-14 04:56:18,260 INFO BEAST.CLI.TRAIN : Output directory: /teamspace/studios/this_studio/results/calms21/beast
2026-02-14 04:56:18,327 INFO BEAST.CLI.TRAIN : Training <class 'beast.models.vits.VisionTransformer'> model
2026-02-14 04:56:18,327 INFO BEAST.CLI.TRAIN : Data directory: /tmp/data/calms21
2026-02-14 04:56:18,327 INFO BEAST.CLI.TRAIN : Output directory: /teamspace/studios/this_studio/results/calms21/beast
2026-02-14 04:56:18,345 INFO BEAST.CLI.TRAIN : Training <class 'beast.models.vits.VisionTransformer'> model
2026-02-14 04:56:18,345 INFO BEAST.CLI.TRAIN : Data directory: /tmp/data/calms21
2026-02-14 04:56:18,345 INFO BEAST.CLI.TRAIN : Output directory: /teamspace/studios/this_studio/results/calms21/beast
2026-02-14 04:56:18,433 INFO BEAST.CLI.TRAIN : Training <class 'beast.models.vits.VisionTransformer'> model
2026-02-14 04:56:18,433 INFO BEAST.CLI.TRAIN : Data directory: /tmp/data/calms21
2026-02-14 04:56:18,433 INFO BEAST.CLI.TRAIN : Output directory: /teamspace/studios/this_studio/results/calms21/beast
2026-02-14 04:56:22,595 INFO lightning.fabric.utilities.distributed : Initializing distributed: GLOBAL_RANK: 4, MEMBER: 5/8
2026-02-14 04:56:22,597 INFO lightning.fabric.utilities.distributed : Initializing distributed: GLOBAL_RANK: 3, MEMBER: 4/8
2026-02-14 04:56:22,989 INFO lightning.fabric.utilities.distributed : Initializing distributed: GLOBAL_RANK: 2, MEMBER: 3/8
2026-02-14 04:56:23,187 INFO lightning.fabric.utilities.distributed : Initializing distributed: GLOBAL_RANK: 1, MEMBER: 2/8
2026-02-14 04:56:23,189 INFO lightning.fabric.utilities.distributed : Initializing distributed: GLOBAL_RANK: 7, MEMBER: 8/8
2026-02-14 04:56:23,194 INFO lightning.fabric.utilities.distributed : Initializing distributed: GLOBAL_RANK: 5, MEMBER: 6/8
2026-02-14 04:56:23,195 INFO lightning.fabric.utilities.distributed : Initializing distributed: GLOBAL_RANK: 6, MEMBER: 7/8
2026-02-14 04:56:23,207 INFO lightning.pytorch.utilities.rank_zero : ----------------------------------------------------------------------------------------------------
distributed_backend=nccl
All distributed processes registered. Starting with 8 processes
----------------------------------------------------------------------------------------------------
2026-02-14 04:56:26,824 INFO lightning.pytorch.accelerators.cuda : LOCAL_RANK: 3 - CUDA_VISIBLE_DEVICES: [0,1,2,3,4,5,6,7]
2026-02-14 04:56:26,824 INFO lightning.pytorch.accelerators.cuda : LOCAL_RANK: 5 - CUDA_VISIBLE_DEVICES: [0,1,2,3,4,5,6,7]
2026-02-14 04:56:26,824 INFO lightning.pytorch.accelerators.cuda : LOCAL_RANK: 4 - CUDA_VISIBLE_DEVICES: [0,1,2,3,4,5,6,7]
2026-02-14 04:56:26,824 INFO lightning.pytorch.accelerators.cuda : LOCAL_RANK: 0 - CUDA_VISIBLE_DEVICES: [0,1,2,3,4,5,6,7]
2026-02-14 04:56:26,824 INFO lightning.pytorch.accelerators.cuda : LOCAL_RANK: 1 - CUDA_VISIBLE_DEVICES: [0,1,2,3,4,5,6,7]
2026-02-14 04:56:26,824 INFO lightning.pytorch.accelerators.cuda : LOCAL_RANK: 6 - CUDA_VISIBLE_DEVICES: [0,1,2,3,4,5,6,7]
2026-02-14 04:56:26,824 INFO lightning.pytorch.accelerators.cuda : LOCAL_RANK: 2 - CUDA_VISIBLE_DEVICES: [0,1,2,3,4,5,6,7]
2026-02-14 04:56:26,824 INFO lightning.pytorch.accelerators.cuda : LOCAL_RANK: 7 - CUDA_VISIBLE_DEVICES: [0,1,2,3,4,5,6,7]
2026-02-14 04:56:27,058 INFO lightning.pytorch.callbacks.model_summary :
| Name | Type | Params | Mode
-------------------------------------------------------
0 | vit_mae | ViTMAE | 111 M | eval
1 | proj | BatchNormProjector | 1.8 M | train
-------------------------------------------------------
113 M Trainable params
252 K Non-trainable params
113 M Total params
454.731 Total estimated model params size (MB)
9 Modules in train mode
353 Modules in eval mode
2026-02-14 18:05:59,995 INFO lightning.pytorch.utilities.rank_zero : `Trainer.fit` stopped: `max_epochs=800` reached.
2026-02-14 18:06:02,794 INFO BEAST.CLI.TRAIN : Training complete. Model saved to /teamspace/studios/this_studio/results/calms21/beast