ProCreations's picture
Publish DiscoGen exact native reproduction
6fd091d verified
Raw
History Blame Contribute Delete
9.66 kB
{
"approximately_99_billion": true,
"assessment": "verified",
"claim": 2,
"destructive_control_detected": true,
"destructive_control_without_on_policy_marl": 1867332264,
"expanded_domain_rows": [
{
"b": 1,
"d": 11,
"domain": "Bayesian Optimisation",
"m": 6,
"reported_tasks": 65413656
},
{
"b": 1,
"d": 7,
"domain": "Brain Speech Detection",
"m": 3,
"reported_tasks": 81144
},
{
"b": 1,
"d": 9,
"domain": "Computer Vision Classification",
"m": 4,
"reported_tasks": 1679400
},
{
"b": 3,
"d": 3,
"domain": "Continual Learning",
"m": 5,
"reported_tasks": 6696
},
{
"b": 1,
"d": 4,
"domain": "Greenhouse Gas Prediction",
"m": 2,
"reported_tasks": 900
},
{
"b": 2,
"d": 4,
"domain": "Language Modelling",
"m": 3,
"reported_tasks": 4200
},
{
"b": 1,
"d": 3,
"domain": "Model Unlearning",
"m": 1,
"reported_tasks": 85176
},
{
"b": 1,
"d": 5,
"domain": "Neural Cellular Automata",
"m": 5,
"reported_tasks": 33480
},
{
"b": 1,
"d": 4,
"domain": "Off-Policy RL",
"m": 7,
"reported_tasks": 38100
},
{
"b": 1,
"d": 10,
"domain": "Offline RL",
"m": 5,
"reported_tasks": 10602372
},
{
"b": 2,
"d": 17,
"domain": "On-Policy MARL",
"m": 6,
"reported_tasks": 97431783120
},
{
"b": 3,
"d": 13,
"domain": "On-Policy RL",
"m": 6,
"reported_tasks": 1789383960
},
{
"b": 3,
"d": 3,
"domain": "Trajectory Prediction",
"m": 4,
"reported_tasks": 1080
},
{
"b": 1,
"d": 4,
"domain": "Unsupervised Environment Design",
"m": 3,
"reported_tasks": 2100
}
],
"expanded_total_from_rows": 99299115384,
"literal_claim": "Including additional domains beyond the main evaluation set, DiscoGen's total task space reaches approximately 99 billion tasks (Appendix C).",
"official_repository_domains": [
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 11,
"datasets": [
"Ackley1d",
"Ackley2d",
"Branin2d",
"Bukin2d",
"Cosine8d",
"DropWave2d",
"EggHolder2d",
"Griewank5d",
"Hartmann6d",
"HolderTable2d",
"Levy6d"
],
"domain": "BayesianOptimisation",
"model_count": 0,
"module_count": 6,
"modules": [
"acq_fn",
"acq_optimizer",
"next_queries",
"sampler",
"surrogate",
"surrogate_optimizer"
]
},
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 7,
"datasets": [
"LibriBrainSherlock1",
"LibriBrainSherlock2",
"LibriBrainSherlock3",
"LibriBrainSherlock4",
"LibriBrainSherlock5",
"LibriBrainSherlock6",
"LibriBrainSherlock7"
],
"domain": "BrainSpeechDetection",
"model_count": 0,
"module_count": 3,
"modules": [
"loss",
"networks",
"optim"
]
},
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 9,
"datasets": [
"CIFAR10C",
"CIFAR10",
"CIFAR10LT",
"CIFAR100",
"FashionMNIST",
"MNIST",
"OxfordFlowers",
"StanfordCars",
"TinyImageNet"
],
"domain": "ComputerVisionClassification",
"model_count": 0,
"module_count": 4,
"modules": [
"loss",
"networks",
"optim",
"preprocess"
]
},
{
"backend_count": 3,
"backends": [
"default",
"parameter_isolation",
"transformer"
],
"dataset_count": 3,
"datasets": [
"PermutedMNIST",
"SplitCIFAR100",
"TinyImageNetSplit"
],
"domain": "ContinualLearning",
"model_count": 0,
"module_count": 5,
"modules": [
"optim",
"regularizer",
"replay",
"sampler",
"scheduler"
]
},
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 4,
"datasets": [
"CH4",
"CO2",
"N2O",
"SF6"
],
"domain": "GreenhouseGasPrediction",
"model_count": 0,
"module_count": 2,
"modules": [
"data_processing",
"model"
]
},
{
"backend_count": 2,
"backends": [
"default",
"ssm"
],
"dataset_count": 4,
"datasets": [
"OPCFineWebCode",
"OPCFineWebMath",
"LMFineWeb",
"TinyStories"
],
"domain": "LanguageModelling",
"model_count": 0,
"module_count": 3,
"modules": [
"loss",
"networks",
"optim"
]
},
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 3,
"datasets": [
"muse",
"tofu",
"wmdp_cyber"
],
"domain": "ModelUnlearning",
"model_count": 13,
"module_count": 1,
"modules": [
"loss"
]
},
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 5,
"datasets": [
"GrowingLizard",
"GrowingButterfly",
"SelfClassifyingMNIST",
"MatrixOperations",
"MNISTInpainting"
],
"domain": "NeuralCellularAutomata",
"model_count": 0,
"module_count": 5,
"modules": [
"loss",
"optimiser",
"perceive",
"train",
"update"
]
},
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 4,
"datasets": [
"MinAtar/Asterix",
"MinAtar/Breakout",
"MinAtar/Freeway",
"MinAtar/SpaceInvaders"
],
"domain": "OffPolicyRL",
"model_count": 0,
"module_count": 7,
"modules": [
"config",
"networks",
"optim",
"policy",
"q_update",
"rb",
"train"
]
},
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 10,
"datasets": [
"OGBench/antmaze-giant-navigate",
"OGBench/antmaze-large-navigate",
"OGBench/antsoccer-arena-navigate",
"OGBench/cube-double-play",
"OGBench/cube-single-play",
"OGBench/humanoidmaze-large-navigate",
"OGBench/humanoidmaze-medium-navigate",
"OGBench/puzzle-3x3-play",
"OGBench/puzzle-4x4-play",
"OGBench/scene-play"
],
"domain": "OfflineRL",
"model_count": 0,
"module_count": 5,
"modules": [
"actor_loss",
"critic_loss",
"networks",
"optim",
"train"
]
},
{
"backend_count": 2,
"backends": [
"default",
"recurrent"
],
"dataset_count": 17,
"datasets": [
"MABrax/Ant",
"MABrax/HalfCheetah",
"MABrax/Hopper",
"MABrax/Walker",
"MABrax/Humanoid",
"MPE/Spread",
"SMAX/2s3z",
"SMAX/3s_vs_5z",
"SMAX/3s5z",
"SMAX/3s5z_vs_3s6z",
"SMAX/5m_vs_6m",
"SMAX/6h_vs_8z",
"SMAX/10m_vs_11m",
"SMAX/27m_vs_30m",
"SMAX/smacv2_5_units",
"SMAX/smacv2_10_units",
"SMAX/smacv2_20_units"
],
"domain": "OnPolicyMARL",
"model_count": 0,
"module_count": 6,
"modules": [
"activation",
"loss",
"networks",
"optim",
"targets",
"train"
]
},
{
"backend_count": 3,
"backends": [
"default",
"recurrent",
"transformer"
],
"dataset_count": 13,
"datasets": [
"MinAtar/Asterix",
"MinAtar/Breakout",
"MinAtar/Freeway",
"MinAtar/SpaceInvaders",
"Brax/Ant",
"Brax/HalfCheetah",
"Brax/Hopper",
"Brax/Humanoid",
"Brax/Pusher",
"Brax/Reacher",
"Brax/Walker2D",
"Craftax/Craftax",
"Craftax/Craftax-Classic"
],
"domain": "OnPolicyRL",
"model_count": 0,
"module_count": 6,
"modules": [
"activation",
"loss",
"networks",
"optim",
"targets",
"train"
]
},
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 3,
"datasets": [
"Argoverse2",
"nuScenes",
"Waymo"
],
"domain": "TrajectoryPrediction",
"model_count": 0,
"module_count": 4,
"modules": [
"loss",
"networks",
"optim",
"train"
]
},
{
"backend_count": 1,
"backends": [
"default"
],
"dataset_count": 4,
"datasets": [
"Kinetix/Small",
"Kinetix/Medium",
"Kinetix/Large",
"Minigrid"
],
"domain": "UnsupervisedEnvironmentDesign",
"model_count": 0,
"module_count": 3,
"modules": [
"sample_levels",
"train_step",
"variable_config"
]
}
],
"reported_expanded_total": 99299115384,
"repository_domain_count": 14
}