shank commited on
Commit Β·
a07dc7f
1
Parent(s): 3293f97
Made changes to train_grpo
Browse files- training/train_grpo.py +2 -0
training/train_grpo.py
CHANGED
|
@@ -37,6 +37,8 @@ parser.add_argument("--resume", type=str, default=None, help="Path to checkpoint
|
|
| 37 |
parser.add_argument("--max_steps", type=int, default=500)
|
| 38 |
args = parser.parse_args()
|
| 39 |
|
|
|
|
|
|
|
| 40 |
# ββ Runtime dependency install βββββββββββββββββββββββββββββββββββββββββββββββββ
|
| 41 |
# requirements.txt only has torch (too large to install at runtime).
|
| 42 |
# Everything else is installed here, after gradio is already up.
|
|
|
|
| 37 |
parser.add_argument("--max_steps", type=int, default=500)
|
| 38 |
args = parser.parse_args()
|
| 39 |
|
| 40 |
+
HF_TOKEN = os.getenv("HF_TOKEN")
|
| 41 |
+
WANDB_API_KEY = os.getenv("WANDB_API_KEY")
|
| 42 |
# ββ Runtime dependency install βββββββββββββββββββββββββββββββββββββββββββββββββ
|
| 43 |
# requirements.txt only has torch (too large to install at runtime).
|
| 44 |
# Everything else is installed here, after gradio is already up.
|