{ "mean_reward": 1000.0, "eval_mean_best": 1000.0, "is_deterministic": true, "D": 64, "seed": 123, "algo": "Hybrid-HD-PPO", "env": "InvertedPendulum-v5", "beta_base": 0.7071067690849304, "beta_bands": null, "std_reward": 0.0, "ci95_reward": 0.0, "n_eval_episodes": 20 }