Abhishek Tiwari commited on
Commit
c11d056
·
1 Parent(s): ebcd8b6

fix: rename rewards= to score= and add task= to END block in stdout for proper validator parsing

Browse files
Files changed (1) hide show
  1. inference.py +2 -2
inference.py CHANGED
@@ -107,7 +107,7 @@ def run_episode(task_id: str):
107
 
108
  print(f"[START] task={task_id} env={ENV_NAME} model={MODEL_NAME}", flush=True)
109
 
110
- best_reward = 0.0
111
  history = []
112
 
113
  step = 0
@@ -170,7 +170,7 @@ def run_episode(task_id: str):
170
  success_str = "true" if best_reward > 0.8 else "false"
171
  best_reward_formatted = f"{best_reward:.2f}"
172
 
173
- print(f"[END] success={success_str} steps={step} rewards={best_reward_formatted}", flush=True)
174
 
175
  def main():
176
  # Only process the tasks quietly!
 
107
 
108
  print(f"[START] task={task_id} env={ENV_NAME} model={MODEL_NAME}", flush=True)
109
 
110
+ best_reward = 0.05
111
  history = []
112
 
113
  step = 0
 
170
  success_str = "true" if best_reward > 0.8 else "false"
171
  best_reward_formatted = f"{best_reward:.2f}"
172
 
173
+ print(f"[END] task={task_id} success={success_str} steps={step} score={best_reward_formatted}", flush=True)
174
 
175
  def main():
176
  # Only process the tasks quietly!