{ "approximately_99_billion": true, "assessment": "verified", "claim": 2, "destructive_control_detected": true, "destructive_control_without_on_policy_marl": 1867332264, "expanded_domain_rows": [ { "b": 1, "d": 11, "domain": "Bayesian Optimisation", "m": 6, "reported_tasks": 65413656 }, { "b": 1, "d": 7, "domain": "Brain Speech Detection", "m": 3, "reported_tasks": 81144 }, { "b": 1, "d": 9, "domain": "Computer Vision Classification", "m": 4, "reported_tasks": 1679400 }, { "b": 3, "d": 3, "domain": "Continual Learning", "m": 5, "reported_tasks": 6696 }, { "b": 1, "d": 4, "domain": "Greenhouse Gas Prediction", "m": 2, "reported_tasks": 900 }, { "b": 2, "d": 4, "domain": "Language Modelling", "m": 3, "reported_tasks": 4200 }, { "b": 1, "d": 3, "domain": "Model Unlearning", "m": 1, "reported_tasks": 85176 }, { "b": 1, "d": 5, "domain": "Neural Cellular Automata", "m": 5, "reported_tasks": 33480 }, { "b": 1, "d": 4, "domain": "Off-Policy RL", "m": 7, "reported_tasks": 38100 }, { "b": 1, "d": 10, "domain": "Offline RL", "m": 5, "reported_tasks": 10602372 }, { "b": 2, "d": 17, "domain": "On-Policy MARL", "m": 6, "reported_tasks": 97431783120 }, { "b": 3, "d": 13, "domain": "On-Policy RL", "m": 6, "reported_tasks": 1789383960 }, { "b": 3, "d": 3, "domain": "Trajectory Prediction", "m": 4, "reported_tasks": 1080 }, { "b": 1, "d": 4, "domain": "Unsupervised Environment Design", "m": 3, "reported_tasks": 2100 } ], "expanded_total_from_rows": 99299115384, "literal_claim": "Including additional domains beyond the main evaluation set, DiscoGen's total task space reaches approximately 99 billion tasks (Appendix C).", "official_repository_domains": [ { "backend_count": 1, "backends": [ "default" ], "dataset_count": 11, "datasets": [ "Ackley1d", "Ackley2d", "Branin2d", "Bukin2d", "Cosine8d", "DropWave2d", "EggHolder2d", "Griewank5d", "Hartmann6d", "HolderTable2d", "Levy6d" ], "domain": "BayesianOptimisation", "model_count": 0, "module_count": 6, "modules": [ "acq_fn", "acq_optimizer", "next_queries", "sampler", "surrogate", "surrogate_optimizer" ] }, { "backend_count": 1, "backends": [ "default" ], "dataset_count": 7, "datasets": [ "LibriBrainSherlock1", "LibriBrainSherlock2", "LibriBrainSherlock3", "LibriBrainSherlock4", "LibriBrainSherlock5", "LibriBrainSherlock6", "LibriBrainSherlock7" ], "domain": "BrainSpeechDetection", "model_count": 0, "module_count": 3, "modules": [ "loss", "networks", "optim" ] }, { "backend_count": 1, "backends": [ "default" ], "dataset_count": 9, "datasets": [ "CIFAR10C", "CIFAR10", "CIFAR10LT", "CIFAR100", "FashionMNIST", "MNIST", "OxfordFlowers", "StanfordCars", "TinyImageNet" ], "domain": "ComputerVisionClassification", "model_count": 0, "module_count": 4, "modules": [ "loss", "networks", "optim", "preprocess" ] }, { "backend_count": 3, "backends": [ "default", "parameter_isolation", "transformer" ], "dataset_count": 3, "datasets": [ "PermutedMNIST", "SplitCIFAR100", "TinyImageNetSplit" ], "domain": "ContinualLearning", "model_count": 0, "module_count": 5, "modules": [ "optim", "regularizer", "replay", "sampler", "scheduler" ] }, { "backend_count": 1, "backends": [ "default" ], "dataset_count": 4, "datasets": [ "CH4", "CO2", "N2O", "SF6" ], "domain": "GreenhouseGasPrediction", "model_count": 0, "module_count": 2, "modules": [ "data_processing", "model" ] }, { "backend_count": 2, "backends": [ "default", "ssm" ], "dataset_count": 4, "datasets": [ "OPCFineWebCode", "OPCFineWebMath", "LMFineWeb", "TinyStories" ], "domain": "LanguageModelling", "model_count": 0, "module_count": 3, "modules": [ "loss", "networks", "optim" ] }, { "backend_count": 1, "backends": [ "default" ], "dataset_count": 3, "datasets": [ "muse", "tofu", "wmdp_cyber" ], "domain": "ModelUnlearning", "model_count": 13, "module_count": 1, "modules": [ "loss" ] }, { "backend_count": 1, "backends": [ "default" ], "dataset_count": 5, "datasets": [ "GrowingLizard", "GrowingButterfly", "SelfClassifyingMNIST", "MatrixOperations", "MNISTInpainting" ], "domain": "NeuralCellularAutomata", "model_count": 0, "module_count": 5, "modules": [ "loss", "optimiser", "perceive", "train", "update" ] }, { "backend_count": 1, "backends": [ "default" ], "dataset_count": 4, "datasets": [ "MinAtar/Asterix", "MinAtar/Breakout", "MinAtar/Freeway", "MinAtar/SpaceInvaders" ], "domain": "OffPolicyRL", "model_count": 0, "module_count": 7, "modules": [ "config", "networks", "optim", "policy", "q_update", "rb", "train" ] }, { "backend_count": 1, "backends": [ "default" ], "dataset_count": 10, "datasets": [ "OGBench/antmaze-giant-navigate", "OGBench/antmaze-large-navigate", "OGBench/antsoccer-arena-navigate", "OGBench/cube-double-play", "OGBench/cube-single-play", "OGBench/humanoidmaze-large-navigate", "OGBench/humanoidmaze-medium-navigate", "OGBench/puzzle-3x3-play", "OGBench/puzzle-4x4-play", "OGBench/scene-play" ], "domain": "OfflineRL", "model_count": 0, "module_count": 5, "modules": [ "actor_loss", "critic_loss", "networks", "optim", "train" ] }, { "backend_count": 2, "backends": [ "default", "recurrent" ], "dataset_count": 17, "datasets": [ "MABrax/Ant", "MABrax/HalfCheetah", "MABrax/Hopper", "MABrax/Walker", "MABrax/Humanoid", "MPE/Spread", "SMAX/2s3z", "SMAX/3s_vs_5z", "SMAX/3s5z", "SMAX/3s5z_vs_3s6z", "SMAX/5m_vs_6m", "SMAX/6h_vs_8z", "SMAX/10m_vs_11m", "SMAX/27m_vs_30m", "SMAX/smacv2_5_units", "SMAX/smacv2_10_units", "SMAX/smacv2_20_units" ], "domain": "OnPolicyMARL", "model_count": 0, "module_count": 6, "modules": [ "activation", "loss", "networks", "optim", "targets", "train" ] }, { "backend_count": 3, "backends": [ "default", "recurrent", "transformer" ], "dataset_count": 13, "datasets": [ "MinAtar/Asterix", "MinAtar/Breakout", "MinAtar/Freeway", "MinAtar/SpaceInvaders", "Brax/Ant", "Brax/HalfCheetah", "Brax/Hopper", "Brax/Humanoid", "Brax/Pusher", "Brax/Reacher", "Brax/Walker2D", "Craftax/Craftax", "Craftax/Craftax-Classic" ], "domain": "OnPolicyRL", "model_count": 0, "module_count": 6, "modules": [ "activation", "loss", "networks", "optim", "targets", "train" ] }, { "backend_count": 1, "backends": [ "default" ], "dataset_count": 3, "datasets": [ "Argoverse2", "nuScenes", "Waymo" ], "domain": "TrajectoryPrediction", "model_count": 0, "module_count": 4, "modules": [ "loss", "networks", "optim", "train" ] }, { "backend_count": 1, "backends": [ "default" ], "dataset_count": 4, "datasets": [ "Kinetix/Small", "Kinetix/Medium", "Kinetix/Large", "Minigrid" ], "domain": "UnsupervisedEnvironmentDesign", "model_count": 0, "module_count": 3, "modules": [ "sample_levels", "train_step", "variable_config" ] } ], "reported_expanded_total": 99299115384, "repository_domain_count": 14 }