Spaces:
Sleeping
Sleeping
Commit ·
341aec9
1
Parent(s): e965a47
restore SQLTask and SQLReward to models.py
Browse files- sql_env/models.py +28 -3
sql_env/models.py
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
-
from typing import List, Optional, Any,
|
| 2 |
from openenv.core.env_server.types import Action, Observation, State
|
| 3 |
-
from pydantic import Field
|
| 4 |
|
| 5 |
|
| 6 |
class SQLAction(Action):
|
|
@@ -26,4 +26,29 @@ class SQLState(State):
|
|
| 26 |
max_steps: int
|
| 27 |
done: bool
|
| 28 |
last_reward: float
|
| 29 |
-
rewards_history: List[float]
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
from typing import List, Optional, Any, Callable
|
| 2 |
from openenv.core.env_server.types import Action, Observation, State
|
| 3 |
+
from pydantic import Field, BaseModel
|
| 4 |
|
| 5 |
|
| 6 |
class SQLAction(Action):
|
|
|
|
| 26 |
max_steps: int
|
| 27 |
done: bool
|
| 28 |
last_reward: float
|
| 29 |
+
rewards_history: List[float]
|
| 30 |
+
|
| 31 |
+
|
| 32 |
+
class SQLReward(BaseModel):
|
| 33 |
+
value: float = Field(gt=0.0, lt=1.0)
|
| 34 |
+
reason: str
|
| 35 |
+
|
| 36 |
+
|
| 37 |
+
class SQLTask(BaseModel):
|
| 38 |
+
task_id: str
|
| 39 |
+
difficulty: str
|
| 40 |
+
broken_query: str
|
| 41 |
+
canonical_answer: str
|
| 42 |
+
schema_context: Optional[str] = None
|
| 43 |
+
error_hint: Optional[str] = None
|
| 44 |
+
max_steps: int = 5
|
| 45 |
+
grader: Optional[Any] = Field(default=None, exclude=True)
|
| 46 |
+
|
| 47 |
+
model_config = {"arbitrary_types_allowed": True}
|
| 48 |
+
|
| 49 |
+
|
| 50 |
+
class StepResult(BaseModel):
|
| 51 |
+
observation: SQLObservation
|
| 52 |
+
reward: float
|
| 53 |
+
done: bool
|
| 54 |
+
info: dict = Field(default_factory=dict)
|