thorodin103 commited on
Commit
eaf9bb6
·
verified ·
1 Parent(s): 27324f5

Upload inference.py with huggingface_hub

Browse files
Files changed (1) hide show
  1. inference.py +3 -3
inference.py CHANGED
@@ -25,7 +25,7 @@ from openai import OpenAI
25
 
26
  API_BASE_URL = os.getenv("API_BASE_URL", "https://router.huggingface.co/v1")
27
  API_KEY = os.getenv("HF_TOKEN") or os.getenv("API_KEY", "")
28
- MODEL_NAME = os.getenv("MODEL_NAME", "meta-llama/Llama-3.3-70B-Instruct")
29
 
30
  MAX_STEPS = 15
31
  TEMPERATURE = 0.1
@@ -131,7 +131,7 @@ def run_task(
131
 
132
  # Reset
133
  result = env.reset()
134
- obs = result.observation.dict()
135
  done = result.done
136
  step = 0
137
  rewards = []
@@ -177,7 +177,7 @@ def run_task(
177
 
178
  # Step environment
179
  result = env.step(action)
180
- obs = result.observation.dict()
181
  done = result.done
182
  reward = result.reward.total
183
  rewards.append(reward)
 
25
 
26
  API_BASE_URL = os.getenv("API_BASE_URL", "https://router.huggingface.co/v1")
27
  API_KEY = os.getenv("HF_TOKEN") or os.getenv("API_KEY", "")
28
+ MODEL_NAME = os.getenv("MODEL_NAME", "meta-llama/Llama-3.2-3B-Instruct")
29
 
30
  MAX_STEPS = 15
31
  TEMPERATURE = 0.1
 
131
 
132
  # Reset
133
  result = env.reset()
134
+ obs = result.observation.model_dump()
135
  done = result.done
136
  step = 0
137
  rewards = []
 
177
 
178
  # Step environment
179
  result = env.step(action)
180
+ obs = result.observation.model_dump()
181
  done = result.done
182
  reward = result.reward.total
183
  rewards.append(reward)