tmp_200 / run.sh
waynelm's picture
Upload 5 files
60b4efc verified
Raw
History Blame Contribute Delete
949 Bytes
ssh 110.129.0.18
docker exec -it verl bash
cd /mnt/models/wh/code/MindSpeed-LLM-v2.3.0
conda activate ms
#unset http_proxy
#unset https_proxy
wandb login
# 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
# wandb login --relogin
source /usr/local/Ascend/cann/ascend-toolkit/set_env.sh
source /usr/local/Ascend/cann/nnal/atb/set_env.sh
bash examples/mcore/qwen3/pretrain_qwen3_0point6b_4K_ptd_new-150M-16.sh
bash examples/mcore/qwen3/pretrain_qwen3_0point6b_4K_ptd_new-150M-18.sh
bash examples/mcore/qwen3/pretrain_qwen3_0point6b_4K_ptd_new-150M-20.sh
bash examples/mcore/qwen3/pretrain_qwen3_0point6b_4K_ptd_new-150M-22.sh
export CUDA_DEVICE_MAX_CONNECTIONS=1
python convert_ckpt_v2.py --load-model-type mg --save-model-type hf \
--load-dir /mnt/models/wh/models/qwen_200m_0615 \
--save-dir /mnt/models/wh/models/qwen_200m_0615/200M_hf/ \
--model-type-hf qwen3
kill -9 $(pgrep -f python)