Fix Qwen3 thinking mode + increase max_new_tokens: training/launch_hf_job.py
Browse files
training/launch_hf_job.py
CHANGED
|
@@ -169,7 +169,7 @@ def main() -> None:
|
|
| 169 |
p.add_argument("--max-train-tasks", type=int, default=None)
|
| 170 |
p.add_argument("--eval-holdout-canonical", type=int, default=3)
|
| 171 |
p.add_argument("--eval-holdout-hard", type=int, default=3)
|
| 172 |
-
p.add_argument("--max-new-tokens", type=int, default=
|
| 173 |
p.add_argument("--max-prompt-tokens", type=int, default=2048)
|
| 174 |
p.add_argument("--format-warmup-tasks", type=int, default=8)
|
| 175 |
p.add_argument("--format-warmup-model-id", default=None)
|
|
|
|
| 169 |
p.add_argument("--max-train-tasks", type=int, default=None)
|
| 170 |
p.add_argument("--eval-holdout-canonical", type=int, default=3)
|
| 171 |
p.add_argument("--eval-holdout-hard", type=int, default=3)
|
| 172 |
+
p.add_argument("--max-new-tokens", type=int, default=384)
|
| 173 |
p.add_argument("--max-prompt-tokens", type=int, default=2048)
|
| 174 |
p.add_argument("--format-warmup-tasks", type=int, default=8)
|
| 175 |
p.add_argument("--format-warmup-model-id", default=None)
|