============================================================ Refinement started at 2026-06-14 23:57:58 ============================================================ Logging to ./refined_adapters/cpp/refine.log Args: Namespace(language='cpp', results_dir='ankhanhtran02/executed_calibration_results', results_source='hf_hub', results_repo_type='model', adapter_path='ankhanhtran02/lora-per-task-executable-start-4', model_name_or_path='Qwen/Qwen2.5-Coder-1.5B', output_dir='./refined_adapters/cpp', per_device_train_batch_size=4, num_train_epochs=3, learning_rate=5e-05, weight_decay=0.01, gradient_accumulation_steps=4, num_warmup_steps=0, max_prompt_len=1024, max_ans_len=2048, seed=42, logging_steps=5, local_rank=0, offload=False, zero_stage=0, gradient_checkpointing=False, disable_dropout=False, run_name='refine_cpp', group_name='refine_adapter', enable_wandb=False, enable_tensorboard=False, tensorboard_path='refine_tensorboard', deepspeed=True, deepspeed_config=None, deepscale=False, deepscale_config=None, global_rank=0) [refine] Loaded adapter from HF Hub: ankhanhtran02/lora-per-task-executable-start-4/cpp/0 trainable params: 1,867,776 || all params: 1,545,176,576 || trainable%: 0.1208778355180036 [repair] extracted 96 pairs (skipped: 72 no-fail-traceback, 229 no-label) [refine] 96 repair pairs for language=cpp Time to load fused_adam op: 1.4614949226379395 seconds ***** Running adapter refinement ***** language = cpp train pairs = 96 epochs = 3 steps/epoch = 12 total steps = 36 batch/device = 4 grad accum = 4 lr = 5e-05 [epoch 1/3] step 5/12 global_step 5 loss 0.1551 [epoch 1/3] step 10/12 global_step 10 loss 0.1509 [refine] Epoch 1/3 complete. [epoch 2/3] step 3/12 global_step 15 loss 0.1093 [epoch 2/3] step 8/12 global_step 20 loss 0.1210 [refine] Epoch 2/3 complete. [epoch 3/3] step 1/12 global_step 25 loss 0.1935 [epoch 3/3] step 6/12 global_step 30 loss 0.1063 [epoch 3/3] step 11/12 global_step 35 loss 0.0987 [refine] Epoch 3/3 complete. [refine] Saved fine-tuned adapter to ./refined_adapters/cpp