sravaniamere commited on
Commit
3fa3f1b
·
1 Parent(s): 7a6f18c

fix initial reward from 0.0 to 0.001

Browse files
Files changed (2) hide show
  1. sql_env/models.py +1 -1
  2. sql_env/server.py +2 -2
sql_env/models.py CHANGED
@@ -15,7 +15,7 @@ class SQLObservation(Observation):
15
  step_number: int
16
  previous_attempt: Optional[str] = None
17
  feedback: Optional[str] = None
18
- reward: float = 0.0
19
  done: bool = False
20
 
21
 
 
15
  step_number: int
16
  previous_attempt: Optional[str] = None
17
  feedback: Optional[str] = None
18
+ reward: float = 0.001
19
  done: bool = False
20
 
21
 
sql_env/server.py CHANGED
@@ -46,7 +46,7 @@ class SQLCorrectionEnvironment(Environment):
46
  step_number=0,
47
  previous_attempt=None,
48
  feedback=None,
49
- reward=0.0,
50
  done=False,
51
  )
52
 
@@ -80,7 +80,7 @@ class SQLCorrectionEnvironment(Environment):
80
  step_count=0,
81
  max_steps=0,
82
  done=False,
83
- last_reward=0.0,
84
  rewards_history=[],
85
  )
86
  return SQLState(
 
46
  step_number=0,
47
  previous_attempt=None,
48
  feedback=None,
49
+ reward=0.001,
50
  done=False,
51
  )
52
 
 
80
  step_count=0,
81
  max_steps=0,
82
  done=False,
83
+ last_reward=0.001,
84
  rewards_history=[],
85
  )
86
  return SQLState(