piyush-mk commited on
Commit
befff2d
·
verified ·
1 Parent(s): 664fa8e

Fix Qwen3 thinking mode + increase max_new_tokens: training/launch_hf_job.py

Browse files
Files changed (1) hide show
  1. training/launch_hf_job.py +1 -1
training/launch_hf_job.py CHANGED
@@ -169,7 +169,7 @@ def main() -> None:
169
  p.add_argument("--max-train-tasks", type=int, default=None)
170
  p.add_argument("--eval-holdout-canonical", type=int, default=3)
171
  p.add_argument("--eval-holdout-hard", type=int, default=3)
172
- p.add_argument("--max-new-tokens", type=int, default=96)
173
  p.add_argument("--max-prompt-tokens", type=int, default=2048)
174
  p.add_argument("--format-warmup-tasks", type=int, default=8)
175
  p.add_argument("--format-warmup-model-id", default=None)
 
169
  p.add_argument("--max-train-tasks", type=int, default=None)
170
  p.add_argument("--eval-holdout-canonical", type=int, default=3)
171
  p.add_argument("--eval-holdout-hard", type=int, default=3)
172
+ p.add_argument("--max-new-tokens", type=int, default=384)
173
  p.add_argument("--max-prompt-tokens", type=int, default=2048)
174
  p.add_argument("--format-warmup-tasks", type=int, default=8)
175
  p.add_argument("--format-warmup-model-id", default=None)