W0715 00:29:35.413000 2481536 site-packages/torch/distributed/run.py:766] W0715 00:29:35.413000 2481536 site-packages/torch/distributed/run.py:766] ***************************************** W0715 00:29:35.413000 2481536 site-packages/torch/distributed/run.py:766] Setting OMP_NUM_THREADS environment variable for each process to be 1 in default, to avoid your system being overloaded, please further tune the variable for optimal performance in your application as needed. W0715 00:29:35.413000 2481536 site-packages/torch/distributed/run.py:766] ***************************************** [INFO] Running in WANDB offline mode [INFO] Running in WANDB offline mode [INFO] Running in WANDB offline mode [INFO] Running in WANDB offline mode [INFO] Running in WANDB offline mode [INFO] Running in WANDB offline mode [INFO] Running in WANDB offline mode [INFO] Running in WANDB offline mode Trainer._get_train_sampler replaced with custom implementation. warmup_ratio is deprecated and will be removed in v5.2. Use `warmup_steps` instead. [2026-07-15 00:29:44,709] [INFO] [real_accelerator.py:222:get_accelerator] Setting ds_accelerator to cuda (auto detect) df: /home/dungpq6/.triton/autotune: No such file or directory Trainer._get_train_sampler replaced with custom implementation. warmup_ratio is deprecated and will be removed in v5.2. Use `warmup_steps` instead. [2026-07-15 00:29:44,968] [INFO] [real_accelerator.py:222:get_accelerator] Setting ds_accelerator to cuda (auto detect) Trainer._get_train_sampler replaced with custom implementation. Trainer._get_train_sampler replaced with custom implementation. warmup_ratio is deprecated and will be removed in v5.2. Use `warmup_steps` instead. Trainer._get_train_sampler replaced with custom implementation. warmup_ratio is deprecated and will be removed in v5.2. Use `warmup_steps` instead. warmup_ratio is deprecated and will be removed in v5.2. Use `warmup_steps` instead. [2026-07-15 00:29:45,065] [INFO] [real_accelerator.py:222:get_accelerator] Setting ds_accelerator to cuda (auto detect) [2026-07-15 00:29:45,065] [INFO] [real_accelerator.py:222:get_accelerator] Setting ds_accelerator to cuda (auto detect) [2026-07-15 00:29:45,076] [INFO] [real_accelerator.py:222:get_accelerator] Setting ds_accelerator to cuda (auto detect) [2026-07-15 00:29:45,087] [INFO] [comm.py:658:init_distributed] cdb=None Trainer._get_train_sampler replaced with custom implementation. warmup_ratio is deprecated and will be removed in v5.2. Use `warmup_steps` instead. [2026-07-15 00:29:45,219] [INFO] [real_accelerator.py:222:get_accelerator] Setting ds_accelerator to cuda (auto detect) Trainer._get_train_sampler replaced with custom implementation. warmup_ratio is deprecated and will be removed in v5.2. Use `warmup_steps` instead. [2026-07-15 00:29:45,274] [INFO] [comm.py:658:init_distributed] cdb=None [2026-07-15 00:29:45,274] [INFO] [comm.py:689:init_distributed] Initializing TorchBackend in DeepSpeed with backend nccl Trainer._get_train_sampler replaced with custom implementation. [2026-07-15 00:29:45,300] [INFO] [real_accelerator.py:222:get_accelerator] Setting ds_accelerator to cuda (auto detect) warmup_ratio is deprecated and will be removed in v5.2. Use `warmup_steps` instead. [2026-07-15 00:29:45,345] [INFO] [real_accelerator.py:222:get_accelerator] Setting ds_accelerator to cuda (auto detect) [2026-07-15 00:29:45,441] [INFO] [comm.py:658:init_distributed] cdb=None [2026-07-15 00:29:45,444] [INFO] [comm.py:658:init_distributed] cdb=None [2026-07-15 00:29:45,449] [INFO] [comm.py:658:init_distributed] cdb=None [2026-07-15 00:29:45,537] [INFO] [comm.py:658:init_distributed] cdb=None [2026-07-15 00:29:45,618] [INFO] [comm.py:658:init_distributed] cdb=None [2026-07-15 00:29:45,666] [INFO] [comm.py:658:init_distributed] cdb=None Loading weights: 0%| | 0/760 [00:00