Spaces:
Running
Running
Update app.py
Browse files
app.py
CHANGED
|
@@ -465,15 +465,34 @@ def build_ui(evaluate_fn):
|
|
| 465 |
return acc, summary
|
| 466 |
|
| 467 |
def _ui_evaluate(description: str, code: str):
|
| 468 |
-
|
| 469 |
-
|
| 470 |
-
|
| 471 |
-
|
| 472 |
-
|
| 473 |
-
|
| 474 |
-
|
| 475 |
-
|
| 476 |
-
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 477 |
|
| 478 |
with gr.Blocks(title="Python Code Evaluator") as demo:
|
| 479 |
|
|
|
|
| 465 |
return acc, summary
|
| 466 |
|
| 467 |
def _ui_evaluate(description: str, code: str):
|
| 468 |
+
verdict, metrics, issues, error = evaluate_fn(description, code)
|
| 469 |
+
accuracy, summary = _split_metrics(metrics)
|
| 470 |
+
|
| 471 |
+
if error:
|
| 472 |
+
# Error occurred β show only the error box, hide all result boxes
|
| 473 |
+
return (
|
| 474 |
+
gr.update(value="", visible=False), # verdict
|
| 475 |
+
gr.update(value="", visible=False), # accuracy
|
| 476 |
+
gr.update(value="", visible=False), # summary
|
| 477 |
+
gr.update(value="", visible=False), # issues
|
| 478 |
+
gr.update(value=error, visible=True), # error β only this shows
|
| 479 |
+
)
|
| 480 |
+
|
| 481 |
+
# No error β show all result boxes, hide the error box
|
| 482 |
+
if "PASS" in verdict.upper():
|
| 483 |
+
verdict_display = "β
PASS"
|
| 484 |
+
elif "FAIL" in verdict.upper():
|
| 485 |
+
verdict_display = "β FAIL"
|
| 486 |
+
else:
|
| 487 |
+
verdict_display = verdict or ""
|
| 488 |
+
|
| 489 |
+
return (
|
| 490 |
+
gr.update(value=verdict_display, visible=True), # verdict
|
| 491 |
+
gr.update(value=accuracy, visible=True), # accuracy
|
| 492 |
+
gr.update(value=summary, visible=True), # summary
|
| 493 |
+
gr.update(value=issues, visible=True), # issues
|
| 494 |
+
gr.update(value="", visible=False), # error β hidden when no error
|
| 495 |
+
)
|
| 496 |
|
| 497 |
with gr.Blocks(title="Python Code Evaluator") as demo:
|
| 498 |
|