shank commited on
Commit
a07dc7f
Β·
1 Parent(s): 3293f97

Made changes to train_grpo

Browse files
Files changed (1) hide show
  1. training/train_grpo.py +2 -0
training/train_grpo.py CHANGED
@@ -37,6 +37,8 @@ parser.add_argument("--resume", type=str, default=None, help="Path to checkpoint
37
  parser.add_argument("--max_steps", type=int, default=500)
38
  args = parser.parse_args()
39
 
 
 
40
  # ── Runtime dependency install ─────────────────────────────────────────────────
41
  # requirements.txt only has torch (too large to install at runtime).
42
  # Everything else is installed here, after gradio is already up.
 
37
  parser.add_argument("--max_steps", type=int, default=500)
38
  args = parser.parse_args()
39
 
40
+ HF_TOKEN = os.getenv("HF_TOKEN")
41
+ WANDB_API_KEY = os.getenv("WANDB_API_KEY")
42
  # ── Runtime dependency install ─────────────────────────────────────────────────
43
  # requirements.txt only has torch (too large to install at runtime).
44
  # Everything else is installed here, after gradio is already up.