Spaces:
Sleeping
Sleeping
| {"episode": 1, "task": "task_1_easy_impute", "level": 1, "reward": 0.199, "accuracy_gain": 0.084, "steps_used": 15, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 2, "task": "task_1_easy_impute", "level": 1, "reward": -0.239, "accuracy_gain": 0.073, "steps_used": 19, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 3, "task": "task_1_easy_balance", "level": 1, "reward": -0.443, "accuracy_gain": 0.0, "steps_used": 14, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 4, "task": "task_1_easy_normalize", "level": 1, "reward": -0.196, "accuracy_gain": 0.316, "steps_used": 14, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 5, "task": "task_1_easy_impute", "level": 1, "reward": 0.115, "accuracy_gain": 0.108, "steps_used": 18, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 6, "task": "task_1_easy_balance", "level": 1, "reward": -0.319, "accuracy_gain": 0.037, "steps_used": 18, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 7, "task": "task_1_easy_balance", "level": 1, "reward": 0.023, "accuracy_gain": 0.079, "steps_used": 14, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 8, "task": "task_1_easy_balance", "level": 1, "reward": -0.16, "accuracy_gain": 0.32, "steps_used": 17, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 9, "task": "task_1_easy_impute", "level": 1, "reward": 0.089, "accuracy_gain": 0.106, "steps_used": 14, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 10, "task": "task_1_easy_balance", "level": 1, "reward": 0.037, "accuracy_gain": 0.385, "steps_used": 13, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 11, "task": "task_1_easy_normalize", "level": 1, "reward": 0.448, "accuracy_gain": 0.164, "steps_used": 16, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 12, "task": "task_1_easy_balance", "level": 1, "reward": -0.096, "accuracy_gain": 0.527, "steps_used": 19, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 13, "task": "task_1_easy_normalize", "level": 1, "reward": 0.025, "accuracy_gain": 0.449, "steps_used": 13, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 14, "task": "task_1_easy_balance", "level": 1, "reward": -0.049, "accuracy_gain": 0.626, "steps_used": 18, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 15, "task": "task_1_easy_normalize", "level": 1, "reward": 0.384, "accuracy_gain": 0.315, "steps_used": 17, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 16, "task": "task_1_easy_balance", "level": 1, "reward": -0.092, "accuracy_gain": 0.459, "steps_used": 17, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 17, "task": "task_1_easy_normalize", "level": 1, "reward": -0.32, "accuracy_gain": 0.388, "steps_used": 16, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 18, "task": "task_1_easy_balance", "level": 1, "reward": -0.41, "accuracy_gain": 0.437, "steps_used": 14, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 19, "task": "task_1_easy_balance", "level": 1, "reward": -0.143, "accuracy_gain": 0.607, "steps_used": 17, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 20, "task": "task_1_easy_balance", "level": 1, "reward": 0.715, "accuracy_gain": 0.429, "steps_used": 14, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 21, "task": "task_1_easy_impute", "level": 1, "reward": 0.481, "accuracy_gain": 0.428, "steps_used": 13, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 22, "task": "task_1_easy_normalize", "level": 1, "reward": 0.431, "accuracy_gain": 0.558, "steps_used": 12, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 23, "task": "task_1_easy_normalize", "level": 1, "reward": -0.18, "accuracy_gain": 0.773, "steps_used": 14, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 24, "task": "task_1_easy_normalize", "level": 1, "reward": 0.431, "accuracy_gain": 0.879, "steps_used": 18, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 25, "task": "task_1_easy_normalize", "level": 1, "reward": 0.425, "accuracy_gain": 0.594, "steps_used": 13, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 26, "task": "task_1_easy_balance", "level": 1, "reward": 0.911, "accuracy_gain": 0.569, "steps_used": 16, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 27, "task": "task_1_easy_normalize", "level": 1, "reward": 0.43, "accuracy_gain": 0.597, "steps_used": 17, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 28, "task": "task_1_easy_balance", "level": 1, "reward": 0.391, "accuracy_gain": 0.634, "steps_used": 14, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 29, "task": "task_1_easy_balance", "level": 1, "reward": 0.052, "accuracy_gain": 0.694, "steps_used": 16, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 30, "task": "task_1_easy_normalize", "level": 1, "reward": 0.453, "accuracy_gain": 0.845, "steps_used": 11, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 31, "task": "task_1_easy_normalize", "level": 1, "reward": 0.403, "accuracy_gain": 0.999, "steps_used": 11, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 32, "task": "task_1_easy_normalize", "level": 1, "reward": 0.492, "accuracy_gain": 0.976, "steps_used": 12, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 33, "task": "task_1_easy_impute", "level": 1, "reward": 0.413, "accuracy_gain": 0.83, "steps_used": 16, "success": true, "curriculum_stage": "easy"} | |
| {"episode": 34, "task": "task_1_easy_normalize", "level": 1, "reward": 0.186, "accuracy_gain": 0.859, "steps_used": 14, "success": false, "curriculum_stage": "easy"} | |
| {"episode": 35, "task": "task_2_medium_encode", "level": 2, "reward": -0.034, "accuracy_gain": 0.412, "steps_used": 14, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 36, "task": "task_2_medium_join", "level": 2, "reward": 0.477, "accuracy_gain": 0.259, "steps_used": 14, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 37, "task": "task_2_medium_encode", "level": 2, "reward": 0.096, "accuracy_gain": 0.475, "steps_used": 13, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 38, "task": "task_2_medium_outlier", "level": 2, "reward": 0.495, "accuracy_gain": 0.262, "steps_used": 17, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 39, "task": "task_2_medium_outlier", "level": 2, "reward": 0.175, "accuracy_gain": 0.364, "steps_used": 16, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 40, "task": "task_2_medium_outlier", "level": 2, "reward": 0.036, "accuracy_gain": 0.56, "steps_used": 10, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 41, "task": "task_2_medium_join", "level": 2, "reward": 0.281, "accuracy_gain": 0.409, "steps_used": 12, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 42, "task": "task_2_medium_join", "level": 2, "reward": 0.222, "accuracy_gain": 0.422, "steps_used": 13, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 43, "task": "task_2_medium_encode", "level": 2, "reward": 0.059, "accuracy_gain": 0.37, "steps_used": 15, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 44, "task": "task_2_medium_encode", "level": 2, "reward": 0.038, "accuracy_gain": 0.505, "steps_used": 12, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 45, "task": "task_2_medium_join", "level": 2, "reward": 0.558, "accuracy_gain": 0.4, "steps_used": 10, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 46, "task": "task_2_medium_outlier", "level": 2, "reward": 0.292, "accuracy_gain": 0.41, "steps_used": 14, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 47, "task": "task_2_medium_encode", "level": 2, "reward": 0.143, "accuracy_gain": 0.31, "steps_used": 11, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 48, "task": "task_2_medium_encode", "level": 2, "reward": -0.035, "accuracy_gain": 0.314, "steps_used": 11, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 49, "task": "task_2_medium_encode", "level": 2, "reward": 0.795, "accuracy_gain": 0.468, "steps_used": 13, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 50, "task": "task_2_medium_outlier", "level": 2, "reward": 0.074, "accuracy_gain": 0.405, "steps_used": 14, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 51, "task": "task_2_medium_outlier", "level": 2, "reward": -0.064, "accuracy_gain": 0.395, "steps_used": 15, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 52, "task": "task_2_medium_join", "level": 2, "reward": 0.296, "accuracy_gain": 0.596, "steps_used": 13, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 53, "task": "task_2_medium_encode", "level": 2, "reward": 0.33, "accuracy_gain": 0.447, "steps_used": 11, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 54, "task": "task_2_medium_join", "level": 2, "reward": 0.601, "accuracy_gain": 0.38, "steps_used": 11, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 55, "task": "task_2_medium_join", "level": 2, "reward": 0.691, "accuracy_gain": 0.442, "steps_used": 12, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 56, "task": "task_2_medium_join", "level": 2, "reward": 0.137, "accuracy_gain": 0.422, "steps_used": 15, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 57, "task": "task_2_medium_encode", "level": 2, "reward": 0.522, "accuracy_gain": 0.478, "steps_used": 9, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 58, "task": "task_2_medium_outlier", "level": 2, "reward": -0.111, "accuracy_gain": 0.417, "steps_used": 11, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 59, "task": "task_2_medium_encode", "level": 2, "reward": 0.248, "accuracy_gain": 0.469, "steps_used": 14, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 60, "task": "task_2_medium_join", "level": 2, "reward": 0.069, "accuracy_gain": 0.715, "steps_used": 8, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 61, "task": "task_2_medium_outlier", "level": 2, "reward": 0.149, "accuracy_gain": 0.56, "steps_used": 13, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 62, "task": "task_2_medium_join", "level": 2, "reward": 0.444, "accuracy_gain": 0.44, "steps_used": 10, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 63, "task": "task_2_medium_join", "level": 2, "reward": 0.253, "accuracy_gain": 0.565, "steps_used": 12, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 64, "task": "task_2_medium_join", "level": 2, "reward": 0.419, "accuracy_gain": 0.497, "steps_used": 14, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 65, "task": "task_2_medium_encode", "level": 2, "reward": 0.56, "accuracy_gain": 0.491, "steps_used": 10, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 66, "task": "task_2_medium_join", "level": 2, "reward": 0.125, "accuracy_gain": 0.513, "steps_used": 11, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 67, "task": "task_2_medium_join", "level": 2, "reward": 0.16, "accuracy_gain": 0.494, "steps_used": 10, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 68, "task": "task_2_medium_outlier", "level": 2, "reward": 0.012, "accuracy_gain": 0.794, "steps_used": 11, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 69, "task": "task_2_medium_encode", "level": 2, "reward": 0.347, "accuracy_gain": 0.713, "steps_used": 9, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 70, "task": "task_2_medium_join", "level": 2, "reward": -0.217, "accuracy_gain": 0.547, "steps_used": 7, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 71, "task": "task_2_medium_encode", "level": 2, "reward": 0.139, "accuracy_gain": 0.577, "steps_used": 7, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 72, "task": "task_2_medium_outlier", "level": 2, "reward": 0.197, "accuracy_gain": 0.698, "steps_used": 13, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 73, "task": "task_2_medium_encode", "level": 2, "reward": 0.006, "accuracy_gain": 0.597, "steps_used": 8, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 74, "task": "task_2_medium_join", "level": 2, "reward": 0.285, "accuracy_gain": 0.66, "steps_used": 8, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 75, "task": "task_2_medium_encode", "level": 2, "reward": 0.291, "accuracy_gain": 0.796, "steps_used": 10, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 76, "task": "task_2_medium_encode", "level": 2, "reward": 0.382, "accuracy_gain": 0.851, "steps_used": 7, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 77, "task": "task_2_medium_outlier", "level": 2, "reward": 0.332, "accuracy_gain": 0.662, "steps_used": 10, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 78, "task": "task_2_medium_encode", "level": 2, "reward": 0.7, "accuracy_gain": 0.853, "steps_used": 11, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 79, "task": "task_2_medium_encode", "level": 2, "reward": -0.034, "accuracy_gain": 0.689, "steps_used": 8, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 80, "task": "task_2_medium_encode", "level": 2, "reward": 0.748, "accuracy_gain": 0.737, "steps_used": 12, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 81, "task": "task_2_medium_join", "level": 2, "reward": 0.158, "accuracy_gain": 0.642, "steps_used": 8, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 82, "task": "task_2_medium_join", "level": 2, "reward": 0.947, "accuracy_gain": 0.846, "steps_used": 9, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 83, "task": "task_2_medium_encode", "level": 2, "reward": 0.567, "accuracy_gain": 0.784, "steps_used": 11, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 84, "task": "task_2_medium_encode", "level": 2, "reward": 0.247, "accuracy_gain": 0.697, "steps_used": 7, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 85, "task": "task_2_medium_outlier", "level": 2, "reward": 0.15, "accuracy_gain": 0.746, "steps_used": 6, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 86, "task": "task_2_medium_outlier", "level": 2, "reward": 0.221, "accuracy_gain": 0.635, "steps_used": 7, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 87, "task": "task_2_medium_outlier", "level": 2, "reward": 0.425, "accuracy_gain": 0.772, "steps_used": 11, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 88, "task": "task_2_medium_outlier", "level": 2, "reward": 0.187, "accuracy_gain": 0.624, "steps_used": 6, "success": false, "curriculum_stage": "medium"} | |
| {"episode": 89, "task": "task_2_medium_encode", "level": 2, "reward": 0.719, "accuracy_gain": 0.701, "steps_used": 12, "success": true, "curriculum_stage": "medium"} | |
| {"episode": 90, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.521, "accuracy_gain": 0.12, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 91, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.279, "accuracy_gain": 0.074, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 92, "task": "task_3_hard_drift", "level": 3, "reward": -0.056, "accuracy_gain": 0.229, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 93, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.102, "accuracy_gain": 0.349, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 94, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.514, "accuracy_gain": 0.152, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 95, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.197, "accuracy_gain": 0.23, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 96, "task": "task_3_hard_drift", "level": 3, "reward": -0.043, "accuracy_gain": 0.165, "steps_used": 11, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 97, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.188, "accuracy_gain": 0.18, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 98, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.685, "accuracy_gain": 0.411, "steps_used": 11, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 99, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.64, "accuracy_gain": 0.16, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 100, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.163, "accuracy_gain": 0.076, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 101, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.566, "accuracy_gain": 0.238, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 102, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.494, "accuracy_gain": 0.302, "steps_used": 9, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 103, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.186, "accuracy_gain": 0.207, "steps_used": 9, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 104, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.004, "accuracy_gain": 0.216, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 105, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.199, "accuracy_gain": 0.106, "steps_used": 11, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 106, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.388, "accuracy_gain": 0.137, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 107, "task": "task_3_hard_drift", "level": 3, "reward": 0.101, "accuracy_gain": 0.139, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 108, "task": "task_3_hard_drift", "level": 3, "reward": 0.073, "accuracy_gain": 0.193, "steps_used": 9, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 109, "task": "task_3_hard_drift", "level": 3, "reward": -0.221, "accuracy_gain": 0.102, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 110, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.105, "accuracy_gain": 0.207, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 111, "task": "task_3_hard_drift", "level": 3, "reward": 0.005, "accuracy_gain": 0.418, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 112, "task": "task_3_hard_drift", "level": 3, "reward": -0.101, "accuracy_gain": 0.151, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 113, "task": "task_3_hard_drift", "level": 3, "reward": -0.326, "accuracy_gain": 0.119, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 114, "task": "task_3_hard_drift", "level": 3, "reward": 0.161, "accuracy_gain": 0.253, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 115, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.039, "accuracy_gain": 0.254, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 116, "task": "task_3_hard_drift", "level": 3, "reward": -0.056, "accuracy_gain": 0.223, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 117, "task": "task_3_hard_drift", "level": 3, "reward": 0.257, "accuracy_gain": 0.152, "steps_used": 10, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 118, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.101, "accuracy_gain": 0.351, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 119, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.316, "accuracy_gain": 0.207, "steps_used": 8, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 120, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.147, "accuracy_gain": 0.201, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 121, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.032, "accuracy_gain": 0.497, "steps_used": 9, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 122, "task": "task_3_hard_drift", "level": 3, "reward": 0.367, "accuracy_gain": 0.163, "steps_used": 6, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 123, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.221, "accuracy_gain": 0.376, "steps_used": 9, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 124, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.381, "accuracy_gain": 0.276, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 125, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.005, "accuracy_gain": 0.427, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 126, "task": "task_3_hard_drift", "level": 3, "reward": -0.017, "accuracy_gain": 0.221, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 127, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.017, "accuracy_gain": 0.264, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 128, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.057, "accuracy_gain": 0.366, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 129, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.086, "accuracy_gain": 0.374, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 130, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.045, "accuracy_gain": 0.313, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 131, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.403, "accuracy_gain": 0.352, "steps_used": 6, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 132, "task": "task_3_hard_drift", "level": 3, "reward": -0.434, "accuracy_gain": 0.278, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 133, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.474, "accuracy_gain": 0.226, "steps_used": 7, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 134, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.074, "accuracy_gain": 0.276, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 135, "task": "task_3_hard_drift", "level": 3, "reward": -0.066, "accuracy_gain": 0.34, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 136, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.076, "accuracy_gain": 0.481, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 137, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.225, "accuracy_gain": 0.365, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 138, "task": "task_3_hard_drift", "level": 3, "reward": 0.259, "accuracy_gain": 0.408, "steps_used": 11, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 139, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.064, "accuracy_gain": 0.322, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 140, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.545, "accuracy_gain": 0.413, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 141, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.06, "accuracy_gain": 0.637, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 142, "task": "task_3_hard_drift", "level": 3, "reward": -0.385, "accuracy_gain": 0.3, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 143, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.328, "accuracy_gain": 0.281, "steps_used": 12, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 144, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.252, "accuracy_gain": 0.468, "steps_used": 8, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 145, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.251, "accuracy_gain": 0.434, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 146, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.268, "accuracy_gain": 0.285, "steps_used": 12, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 147, "task": "task_3_hard_drift", "level": 3, "reward": 0.494, "accuracy_gain": 0.456, "steps_used": 12, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 148, "task": "task_3_hard_drift", "level": 3, "reward": 0.022, "accuracy_gain": 0.475, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 149, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.66, "accuracy_gain": 0.297, "steps_used": 11, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 150, "task": "task_3_hard_drift", "level": 3, "reward": 0.62, "accuracy_gain": 0.408, "steps_used": 7, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 151, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.247, "accuracy_gain": 0.336, "steps_used": 9, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 152, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.285, "accuracy_gain": 0.356, "steps_used": 11, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 153, "task": "task_3_hard_drift", "level": 3, "reward": 0.426, "accuracy_gain": 0.342, "steps_used": 6, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 154, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.15, "accuracy_gain": 0.571, "steps_used": 9, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 155, "task": "task_3_hard_imbalance", "level": 3, "reward": -0.175, "accuracy_gain": 0.595, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 156, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.003, "accuracy_gain": 0.545, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 157, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.562, "accuracy_gain": 0.391, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 158, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.052, "accuracy_gain": 0.451, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 159, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.996, "accuracy_gain": 0.455, "steps_used": 6, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 160, "task": "task_3_hard_drift", "level": 3, "reward": -0.013, "accuracy_gain": 0.405, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 161, "task": "task_3_hard_drift", "level": 3, "reward": 0.384, "accuracy_gain": 0.395, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 162, "task": "task_3_hard_drift", "level": 3, "reward": -0.044, "accuracy_gain": 0.569, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 163, "task": "task_3_hard_drift", "level": 3, "reward": 0.382, "accuracy_gain": 0.375, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 164, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.24, "accuracy_gain": 0.581, "steps_used": 10, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 165, "task": "task_3_hard_drift", "level": 3, "reward": 0.442, "accuracy_gain": 0.418, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 166, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.157, "accuracy_gain": 0.422, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 167, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.043, "accuracy_gain": 0.628, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 168, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.33, "accuracy_gain": 0.649, "steps_used": 6, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 169, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.354, "accuracy_gain": 0.654, "steps_used": 12, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 170, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.222, "accuracy_gain": 0.424, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 171, "task": "task_3_hard_drift", "level": 3, "reward": 0.754, "accuracy_gain": 0.597, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 172, "task": "task_3_hard_drift", "level": 3, "reward": -0.136, "accuracy_gain": 0.526, "steps_used": 9, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 173, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.05, "accuracy_gain": 0.521, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 174, "task": "task_3_hard_drift", "level": 3, "reward": 0.388, "accuracy_gain": 0.559, "steps_used": 12, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 175, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.74, "accuracy_gain": 0.558, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 176, "task": "task_3_hard_imbalance", "level": 3, "reward": 1.0, "accuracy_gain": 0.787, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 177, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.228, "accuracy_gain": 0.847, "steps_used": 6, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 178, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.267, "accuracy_gain": 0.453, "steps_used": 7, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 179, "task": "task_3_hard_drift", "level": 3, "reward": -0.349, "accuracy_gain": 0.458, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 180, "task": "task_3_hard_drift", "level": 3, "reward": 0.244, "accuracy_gain": 0.591, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 181, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.48, "accuracy_gain": 0.636, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 182, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.174, "accuracy_gain": 0.501, "steps_used": 7, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 183, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.132, "accuracy_gain": 0.607, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 184, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.342, "accuracy_gain": 0.564, "steps_used": 9, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 185, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.167, "accuracy_gain": 0.873, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 186, "task": "task_3_hard_drift", "level": 3, "reward": 0.494, "accuracy_gain": 0.767, "steps_used": 10, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 187, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.369, "accuracy_gain": 0.805, "steps_used": 7, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 188, "task": "task_3_hard_drift", "level": 3, "reward": 0.335, "accuracy_gain": 0.704, "steps_used": 6, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 189, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.064, "accuracy_gain": 0.706, "steps_used": 11, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 190, "task": "task_3_hard_drift", "level": 3, "reward": 0.345, "accuracy_gain": 0.597, "steps_used": 10, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 191, "task": "task_3_hard_pipeline", "level": 3, "reward": 0.614, "accuracy_gain": 0.514, "steps_used": 7, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 192, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.274, "accuracy_gain": 0.681, "steps_used": 12, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 193, "task": "task_3_hard_drift", "level": 3, "reward": -0.498, "accuracy_gain": 0.788, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 194, "task": "task_3_hard_drift", "level": 3, "reward": 0.351, "accuracy_gain": 0.552, "steps_used": 6, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 195, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.488, "accuracy_gain": 0.548, "steps_used": 7, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 196, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.425, "accuracy_gain": 0.672, "steps_used": 10, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 197, "task": "task_3_hard_drift", "level": 3, "reward": 0.132, "accuracy_gain": 0.582, "steps_used": 12, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 198, "task": "task_3_hard_pipeline", "level": 3, "reward": -0.07, "accuracy_gain": 0.705, "steps_used": 8, "success": false, "curriculum_stage": "hard"} | |
| {"episode": 199, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.391, "accuracy_gain": 0.618, "steps_used": 10, "success": true, "curriculum_stage": "hard"} | |
| {"episode": 200, "task": "task_3_hard_imbalance", "level": 3, "reward": 0.812, "accuracy_gain": 0.724, "steps_used": 12, "success": true, "curriculum_stage": "hard"} | |